t5-base-artgen-multi-instruct-OpenVINO / openvino_encoder_model.xml
Mitchins's picture
Upload folder using huggingface_hub
a6cf977 verified
Raw
History Blame Contribute Delete
402 kB
<?xml version="1.0"?>
<net name="Model0" version="11">
<layers>
<layer id="1" name="input_ids" type="Parameter" version="opset1">
<data shape="?,?" element_type="i64" />
<output>
<port id="0" precision="I64" names="input_ids">
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="0" name="attention_mask" type="Parameter" version="opset1">
<data shape="?,?" element_type="i64" />
<output>
<port id="0" precision="I64" names="attention_mask">
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="2" name="Constant_12369" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 768" offset="0" size="3072" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="3" name="self.embed_tokens.weight" type="Const" version="opset1">
<data element_type="f32" shape="32104, 768" offset="3072" size="98623488" />
<output>
<port id="0" precision="FP32" names="self.embed_tokens.weight">
<dim>32104</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="4" name="Constant_12615" type="Const" version="opset1">
<data element_type="i64" shape="2" offset="98626560" size="16" />
<output>
<port id="0" precision="I64">
<dim>2</dim>
</port>
</output>
</layer>
<layer id="5" name="aten::view/Reshape" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="I64">
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="I64">
<dim>2</dim>
</port>
</input>
<output>
<port id="2" precision="I64" names="36,input.1">
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="6" name="__module.embed_tokens/aten::embedding/Convert" type="Convert" version="opset1">
<data destination_type="i32" />
<input>
<port id="0" precision="I64">
<dim>-1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="1" precision="I32">
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="7" name="__module.embed_tokens/aten::embedding/Constant" type="Const" version="opset1">
<data element_type="i32" shape="" offset="98626576" size="4" />
<output>
<port id="0" precision="I32" />
</output>
</layer>
<layer id="8" name="__module.embed_tokens/aten::embedding/Gather" type="Gather" version="opset8">
<data batch_dims="0" />
<input>
<port id="0" precision="FP32">
<dim>32104</dim>
<dim>768</dim>
</port>
<port id="1" precision="I32">
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="2" precision="I32" />
</input>
<output>
<port id="3" precision="FP32" names="128,138,93,hidden_states.3,input.3">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="9" name="Constant_12262" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 768" offset="98626580" size="3072" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="10" name="Constant_12261" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629652" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="11" name="Constant_12259" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629656" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="12" name="__module.block.0.layer.0.layer_norm/aten::pow/Power" type="Power" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="129">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="13" name="Constant_174" type="Const" version="opset1">
<data element_type="i64" shape="1" offset="98629660" size="8" />
<output>
<port id="0" precision="I64" names="130">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="14" name="__module.block.0.layer.0.layer_norm/aten::mean/ReduceMean" type="ReduceMean" version="opset1">
<data keep_dims="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="131,variance.1">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="15" name="Constant_12260" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629668" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="16" name="__module.block.0.layer.0.layer_norm/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="132">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="17" name="__module.block.0.layer.0.layer_norm/aten::rsqrt/Sqrt" type="Sqrt" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="18" name="__module.block.0.layer.0.layer_norm/aten::rsqrt/Divide" type="Divide" version="opset1">
<data auto_broadcast="numpy" m_pythondiv="true" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="133">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="19" name="__module.block.0.layer.0.layer_norm/aten::mul/Multiply" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="134,hidden_states.5">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="20" name="__module.block.0.layer.0.layer_norm/aten::mul/Multiply_1" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="135,137,hidden_states.7">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="21" name="self.block.0.layer.0.SelfAttention.q.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="98629672" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.0.layer.0.SelfAttention.q.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="22" name="__module.block.0.layer.0.SelfAttention.q/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="148,query_states.1">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="23" name="Constant_12616" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="24" name="__module.block.0.layer.0.SelfAttention/aten::view/Reshape" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="150">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="25" name="__module.block.0.layer.0.SelfAttention/aten::transpose/Constant" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="26" name="__module.block.0.layer.0.SelfAttention/aten::transpose/Transpose" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="151,query_states.3">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="27" name="self.block.0.layer.0.SelfAttention.k.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="100989016" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.0.layer.0.SelfAttention.k.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="28" name="__module.block.0.layer.0.SelfAttention.k/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="153,key_states.1">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="29" name="Constant_12617" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="30" name="__module.block.0.layer.0.SelfAttention/aten::view/Reshape_1" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="157">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="31" name="__module.block.0.layer.0.SelfAttention/aten::transpose/Constant_1" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="32" name="__module.block.0.layer.0.SelfAttention/aten::transpose/Transpose_1" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="158,key_states.3">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="33" name="__module.block.0.layer.0.SelfAttention/aten::matmul/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="163_1">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="34" name="self.block.0.layer.0.SelfAttention.relative_attention_bias.weight" type="Const" version="opset1">
<data element_type="f32" shape="32, 12" offset="103348312" size="1536" />
<output>
<port id="0" precision="FP32" names="self.block.0.layer.0.SelfAttention.relative_attention_bias.weight">
<dim>32</dim>
<dim>12</dim>
</port>
</output>
</layer>
<layer id="35" name="__module.block.0.layer.0.SelfAttention/aten::arange/Constant" type="Const" version="opset1">
<data element_type="i32" shape="" offset="98626576" size="4" />
<output>
<port id="0" precision="I32" />
</output>
</layer>
<layer id="36" name="ShapeOf_12525" type="ShapeOf" version="opset3">
<data output_type="i64" />
<input>
<port id="0" precision="I64">
<dim>-1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="1" precision="I64">
<dim>2</dim>
</port>
</output>
</layer>
<layer id="37" name="Constant_12526" type="Const" version="opset1">
<data element_type="i64" shape="" offset="103349848" size="8" />
<output>
<port id="0" precision="I64" />
</output>
</layer>
<layer id="38" name="Constant_12527" type="Const" version="opset1">
<data element_type="i64" shape="" offset="103349856" size="8" />
<output>
<port id="0" precision="I64" />
</output>
</layer>
<layer id="39" name="Gather_12528" type="Gather" version="opset8">
<data batch_dims="0" />
<input>
<port id="0" precision="I64">
<dim>2</dim>
</port>
<port id="1" precision="I64" />
<port id="2" precision="I64" />
</input>
<output>
<port id="3" precision="I64" names="164,200,31,33,40" />
</output>
</layer>
<layer id="40" name="__module.block.0.layer.0.SelfAttention/aten::arange/Constant_1" type="Const" version="opset1">
<data element_type="i32" shape="" offset="103349864" size="4" />
<output>
<port id="0" precision="I32" />
</output>
</layer>
<layer id="41" name="__module.block.0.layer.0.SelfAttention/aten::arange/Range" type="Range" version="opset4">
<data output_type="i64" />
<input>
<port id="0" precision="I32" />
<port id="1" precision="I64" />
<port id="2" precision="I32" />
</input>
<output>
<port id="3" precision="I64" names="168">
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="42" name="119" type="Const" version="opset1">
<data element_type="i64" shape="" offset="103349856" size="8" />
<output>
<port id="0" precision="I64" names="119" />
</output>
</layer>
<layer id="43" name="__module.block.0.layer.0.SelfAttention/aten::unsqueeze/Unsqueeze" type="Unsqueeze" version="opset1">
<input>
<port id="0" precision="I64">
<dim>-1</dim>
</port>
<port id="1" precision="I64" />
</input>
<output>
<port id="2" precision="I64" names="169,170,memory_position">
<dim>1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="44" name="42" type="Const" version="opset1">
<data element_type="i64" shape="" offset="103349856" size="8" />
<output>
<port id="0" precision="I64" names="42" />
</output>
</layer>
<layer id="45" name="aten::arange/Constant" type="Const" version="opset1">
<data element_type="i32" shape="" offset="103349864" size="4" />
<output>
<port id="0" precision="I32" />
</output>
</layer>
<layer id="46" name="aten::arange/Range" type="Range" version="opset4">
<data output_type="f32" />
<input>
<port id="0" precision="I64" />
<port id="1" precision="I64" />
<port id="2" precision="I32" />
</input>
<output>
<port id="3" precision="FP32" names="165,47,cache_position">
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="47" name="97" type="Const" version="opset1">
<data element_type="i64" shape="" offset="103349848" size="8" />
<output>
<port id="0" precision="I64" names="97" />
</output>
</layer>
<layer id="48" name="__module.block.0.layer.0.SelfAttention/aten::unsqueeze/Unsqueeze_1" type="Unsqueeze" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
</port>
<port id="1" precision="I64" />
</input>
<output>
<port id="2" precision="FP32" names="166">
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="49" name="__module.block.0.layer.0.SelfAttention/aten::to/Convert" type="Convert" version="opset1">
<data destination_type="i64" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="1" precision="I64" names="167,context_position">
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="50" name="__module.block.0.layer.0.SelfAttention/aten::sub/Subtract" type="Subtract" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="I64">
<dim>1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="I64">
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="I64" names="171,relative_position.1">
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="51" name="Constant_12263" type="Const" version="opset1">
<data element_type="i64" shape="1, 1" offset="103349856" size="8" />
<output>
<port id="0" precision="I64">
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="52" name="__module.block.0.layer.0.SelfAttention/aten::gt/Greater" type="Greater" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="I64">
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="I64">
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="BOOL" names="172">
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="53" name="__module.block.0.layer.0.SelfAttention/aten::to/Convert_1" type="Convert" version="opset1">
<data destination_type="i64" />
<input>
<port id="0" precision="BOOL">
<dim>-1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="1" precision="I64" names="173">
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="54" name="Constant_12264" type="Const" version="opset1">
<data element_type="i64" shape="1, 1" offset="103349868" size="8" />
<output>
<port id="0" precision="I64">
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="55" name="__module.block.0.layer.0.SelfAttention/aten::mul/Multiply" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="I64">
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="I64">
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="I64" names="174,175_1">
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="56" name="__module.block.0.layer.0.SelfAttention/aten::abs/Abs" type="Abs" version="opset1">
<input>
<port id="0" precision="I64">
<dim>-1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="1" precision="I64" names="176,relative_position">
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="57" name="Constant_12265" type="Const" version="opset1">
<data element_type="i64" shape="1, 1" offset="103349876" size="8" />
<output>
<port id="0" precision="I64">
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="58" name="__module.block.0.layer.0.SelfAttention/aten::lt/Less" type="Less" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="I64">
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="I64">
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="BOOL" names="177,is_small">
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="59" name="__module.block.0.layer.0.SelfAttention/aten::to/Convert_2" type="Convert" version="opset1">
<data destination_type="f32" />
<input>
<port id="0" precision="I64">
<dim>-1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32" names="178">
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="60" name="Constant_12266" type="Const" version="opset1">
<data element_type="f32" shape="1, 1" offset="103349884" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="61" name="__module.block.0.layer.0.SelfAttention/aten::div/Divide" type="Divide" version="opset1">
<data auto_broadcast="numpy" m_pythondiv="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="179">
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="62" name="__module.block.0.layer.0.SelfAttention/aten::log/Log" type="Log" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32" names="180">
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="63" name="Constant_12267" type="Const" version="opset1">
<data element_type="f32" shape="1, 1" offset="103349888" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="64" name="__module.block.0.layer.0.SelfAttention/aten::div/Divide_1" type="Divide" version="opset1">
<data auto_broadcast="numpy" m_pythondiv="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="181">
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="65" name="Constant_12268" type="Const" version="opset1">
<data element_type="f32" shape="1, 1" offset="103349884" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="66" name="__module.block.0.layer.0.SelfAttention/aten::mul/Multiply_1" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="182">
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="67" name="__module.block.0.layer.0.SelfAttention/aten::to/Convert_3" type="Convert" version="opset1">
<data destination_type="i64" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="1" precision="I64" names="183">
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="68" name="Constant_12269" type="Const" version="opset1">
<data element_type="i64" shape="1, 1" offset="103349876" size="8" />
<output>
<port id="0" precision="I64">
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="69" name="__module.block.0.layer.0.SelfAttention/aten::add/Add_1" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="I64">
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="I64">
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="I64" names="184,relative_position_if_large.1">
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="70" name="Constant_12270" type="Const" version="opset1">
<data element_type="i64" shape="1, 1" offset="103349892" size="8" />
<output>
<port id="0" precision="I64">
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="71" name="__module.block.0.layer.0.SelfAttention/aten::min/Minimum" type="Minimum" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="I64">
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="I64">
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="I64" names="186,relative_position_if_large">
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="72" name="__module.block.0.layer.0.SelfAttention/aten::where/Select" type="Select" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="BOOL">
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="I64">
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="2" precision="I64">
<dim>-1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="3" precision="I64" names="187">
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="73" name="__module.block.0.layer.0.SelfAttention/aten::add_/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="I64">
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="I64">
<dim>-1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="2" precision="I64" names="175,relative_buckets">
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="74" name="__module.block.0.layer.0.SelfAttention.relative_attention_bias/aten::embedding/Convert" type="Convert" version="opset1">
<data destination_type="i32" />
<input>
<port id="0" precision="I64">
<dim>-1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="1" precision="I32">
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="75" name="__module.block.0.layer.0.SelfAttention.relative_attention_bias/aten::embedding/Constant" type="Const" version="opset1">
<data element_type="i32" shape="" offset="98626576" size="4" />
<output>
<port id="0" precision="I32" />
</output>
</layer>
<layer id="76" name="__module.block.0.layer.0.SelfAttention.relative_attention_bias/aten::embedding/Gather" type="Gather" version="opset8">
<data batch_dims="0" />
<input>
<port id="0" precision="FP32">
<dim>32</dim>
<dim>12</dim>
</port>
<port id="1" precision="I32">
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="2" precision="I32" />
</input>
<output>
<port id="3" precision="FP32" names="190,values">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
</port>
</output>
</layer>
<layer id="77" name="Constant_504" type="Const" version="opset1">
<data element_type="i64" shape="3" offset="103349900" size="24" />
<output>
<port id="0" precision="I64" names="191">
<dim>3</dim>
</port>
</output>
</layer>
<layer id="78" name="__module.block.0.layer.0.SelfAttention/aten::permute/Transpose" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
</port>
<port id="1" precision="I64">
<dim>3</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="192">
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="79" name="__module.block.0.layer.0.SelfAttention/aten::unsqueeze/Unsqueeze_2" type="Unsqueeze" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="I64" />
</input>
<output>
<port id="2" precision="FP32" names="193,196,197,position_bias.1">
<dim>1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="80" name="Constant_46732" type="Const" version="opset1">
<data element_type="i64" shape="1" offset="98629660" size="8" />
<output>
<port id="0" precision="I64">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="81" name="Reshape_12546" type="Reshape" version="opset1">
<data special_zero="false" />
<input>
<port id="0" precision="I64" />
<port id="1" precision="I64">
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="I64" names="145">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="82" name="__module.block.0.layer.0.SelfAttention/aten::neg/Constant" type="Const" version="opset1">
<data element_type="i32" shape="" offset="103349924" size="4" />
<output>
<port id="0" precision="I32" />
</output>
</layer>
<layer id="83" name="__module.block.0.layer.0.SelfAttention/aten::neg/ConvertLike" type="Convert" version="opset1">
<data destination_type="i64" />
<input>
<port id="0" precision="I32" />
</input>
<output>
<port id="1" precision="I64" />
</output>
</layer>
<layer id="84" name="Constant_46733" type="Const" version="opset1">
<data element_type="i64" shape="1" offset="98629660" size="8" />
<output>
<port id="0" precision="I64">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="85" name="Reshape_9725" type="Reshape" version="opset1">
<data special_zero="false" />
<input>
<port id="0" precision="I64" />
<port id="1" precision="I64">
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="I64">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="86" name="__module.block.0.layer.0.SelfAttention/aten::neg/Multiply" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="I64">
<dim>1</dim>
</port>
<port id="1" precision="I64">
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="I64" names="194,195">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="87" name="Constant_539" type="Const" version="opset1">
<data element_type="i64" shape="1" offset="103349928" size="8" />
<output>
<port id="0" precision="I64">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="88" name="Constant_541" type="Const" version="opset1">
<data element_type="i64" shape="1" offset="103349848" size="8" />
<output>
<port id="0" precision="I64">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="89" name="Constant_536" type="Const" version="opset1">
<data element_type="i64" shape="1" offset="103349936" size="8" />
<output>
<port id="0" precision="I64">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="90" name="__module.block.0.layer.0.SelfAttention/aten::slice/Slice_4" type="Slice" version="opset8">
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="I64">
<dim>1</dim>
</port>
<port id="2" precision="I64">
<dim>1</dim>
</port>
<port id="3" precision="I64">
<dim>1</dim>
</port>
<port id="4" precision="I64">
<dim>1</dim>
</port>
</input>
<output>
<port id="5" precision="FP32" names="198,199,position_bias.3">
<dim>1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="91" name="Constant_12272" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1, 1" offset="98629652" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="92" name="53" type="Const" version="opset1">
<data element_type="i64" shape="" offset="103349848" size="8" />
<output>
<port id="0" precision="I64" names="53" />
</output>
</layer>
<layer id="93" name="aten::unsqueeze/Unsqueeze" type="Unsqueeze" version="opset1">
<input>
<port id="0" precision="I64">
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="I64" />
</input>
<output>
<port id="2" precision="I64" names="54">
<dim>-1</dim>
<dim>1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="94" name="55" type="Const" version="opset1">
<data element_type="i64" shape="" offset="103349936" size="8" />
<output>
<port id="0" precision="I64" names="55" />
</output>
</layer>
<layer id="95" name="aten::unsqueeze/Unsqueeze_1" type="Unsqueeze" version="opset1">
<input>
<port id="0" precision="I64">
<dim>-1</dim>
<dim>1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="I64" />
</input>
<output>
<port id="2" precision="I64" names="56,61,causal_mask.1">
<dim>-1</dim>
<dim>1</dim>
<dim>1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="96" name="aten::to/Convert" type="Convert" version="opset1">
<data destination_type="f32" />
<input>
<port id="0" precision="I64">
<dim>-1</dim>
<dim>1</dim>
<dim>1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32" names="66">
<dim>-1</dim>
<dim>1</dim>
<dim>1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="97" name="Constant_12271" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1, 1" offset="98629652" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="98" name="aten::rsub/Multiply" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>1</dim>
<dim>1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32">
<dim>-1</dim>
<dim>1</dim>
<dim>1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="99" name="aten::rsub/Subtract" type="Subtract" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>1</dim>
<dim>1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="69">
<dim>-1</dim>
<dim>1</dim>
<dim>1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="100" name="Constant_12273" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1, 1" offset="103349944" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="101" name="aten::mul/Multiply" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>1</dim>
<dim>1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="201,202,203,71,mask">
<dim>-1</dim>
<dim>1</dim>
<dim>1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="102" name="Constant_590" type="Const" version="opset1">
<data element_type="i64" shape="1" offset="103349856" size="8" />
<output>
<port id="0" precision="I64">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="103" name="Constant_593" type="Const" version="opset1">
<data element_type="i64" shape="1" offset="103349848" size="8" />
<output>
<port id="0" precision="I64">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="104" name="Constant_588" type="Const" version="opset1">
<data element_type="i64" shape="1" offset="103349948" size="8" />
<output>
<port id="0" precision="I64">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="105" name="__module.block.0.layer.0.SelfAttention/aten::slice/Slice_9" type="Slice" version="opset8">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>1</dim>
<dim>1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="I64">
<dim>1</dim>
</port>
<port id="2" precision="I64">
<dim>1</dim>
</port>
<port id="3" precision="I64">
<dim>1</dim>
</port>
<port id="4" precision="I64">
<dim>1</dim>
</port>
</input>
<output>
<port id="5" precision="FP32" names="204,causal_mask">
<dim>-1</dim>
<dim>1</dim>
<dim>1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="106" name="__module.block.0.layer.0.SelfAttention/aten::add/Add_2" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>1</dim>
<dim>1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="205,220,225,75,position_bias">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="107" name="__module.block.0.layer.0.SelfAttention/aten::add_/Add_1" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="163,207,input.7,scores.1">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="108" name="__module.block.0.layer.0.SelfAttention/aten::softmax/Softmax" type="SoftMax" version="opset8">
<data axis="-1" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32" names="208,209,input.9">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="109" name="self.block.0.layer.0.SelfAttention.v.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="103349956" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.0.layer.0.SelfAttention.v.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="110" name="__module.block.0.layer.0.SelfAttention.v/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="155,value_states.1">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="111" name="Constant_12618" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="112" name="__module.block.0.layer.0.SelfAttention/aten::view/Reshape_2" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="160">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="113" name="__module.block.0.layer.0.SelfAttention/aten::transpose/Constant_3" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="114" name="__module.block.0.layer.0.SelfAttention/aten::transpose/Transpose_3" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="161,value_states.3">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="115" name="__module.block.0.layer.0.SelfAttention/aten::matmul/MatMul_1" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="false" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="211,attn_output.1">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="116" name="__module.block.0.layer.0.SelfAttention/aten::transpose/Constant_4" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="117" name="__module.block.0.layer.0.SelfAttention/aten::transpose/Transpose_4" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="212">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="118" name="Constant_12619" type="Const" version="opset1">
<data element_type="i64" shape="3" offset="105709252" size="24" />
<output>
<port id="0" precision="I64">
<dim>3</dim>
</port>
</output>
</layer>
<layer id="119" name="__module.block.0.layer.0.SelfAttention/aten::view/Reshape_3" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I64">
<dim>3</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="215,input.11">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="120" name="self.block.0.layer.0.SelfAttention.o.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="105709276" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.0.layer.0.SelfAttention.o.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="121" name="__module.block.0.layer.0.SelfAttention.o/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="217,219,input.13">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="122" name="__module.block.0.layer.0/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="222,224,230,240,hidden_states.11,hidden_states.9">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="123" name="Constant_12277" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 768" offset="108068572" size="3072" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="124" name="Constant_12276" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629652" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="125" name="Constant_12274" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629656" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="126" name="__module.block.0.layer.1.layer_norm/aten::pow/Power" type="Power" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="231">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="127" name="Constant_679" type="Const" version="opset1">
<data element_type="i64" shape="1" offset="98629660" size="8" />
<output>
<port id="0" precision="I64" names="232">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="128" name="__module.block.0.layer.1.layer_norm/aten::mean/ReduceMean" type="ReduceMean" version="opset1">
<data keep_dims="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="233,variance.3">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="129" name="Constant_12275" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629668" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="130" name="__module.block.0.layer.1.layer_norm/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="234">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="131" name="__module.block.0.layer.1.layer_norm/aten::rsqrt/Sqrt" type="Sqrt" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="132" name="__module.block.0.layer.1.layer_norm/aten::rsqrt/Divide" type="Divide" version="opset1">
<data auto_broadcast="numpy" m_pythondiv="true" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="235">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="133" name="__module.block.0.layer.1.layer_norm/aten::mul/Multiply" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="236,hidden_states.13">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="134" name="__module.block.0.layer.1.layer_norm/aten::mul/Multiply_1" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="237,239,input.15">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="135" name="self.block.0.layer.1.DenseReluDense.wi.weight" type="Const" version="opset1">
<data element_type="f32" shape="3072, 768" offset="108071644" size="9437184" />
<output>
<port id="0" precision="FP32" names="self.block.0.layer.1.DenseReluDense.wi.weight">
<dim>3072</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="136" name="__module.block.0.layer.1.DenseReluDense.wi/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>3072</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="246,input.17">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="137" name="__module.block.0.layer.1.DenseReluDense.act/aten::relu/Relu" type="ReLU" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</input>
<output>
<port id="1" precision="FP32" names="247,input.19">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="138" name="self.block.0.layer.1.DenseReluDense.wo.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 3072" offset="117508828" size="9437184" />
<output>
<port id="0" precision="FP32" names="self.block.0.layer.1.DenseReluDense.wo.weight">
<dim>768</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="139" name="__module.block.0.layer.1.DenseReluDense.wo/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>3072</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="250,input.23">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="140" name="__module.block.0.layer.1/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="252,276,286,74,hidden_states.15,hidden_states.17">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="141" name="Constant_12281" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 768" offset="126946012" size="3072" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="142" name="Constant_12280" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629652" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="143" name="Constant_12278" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629656" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="144" name="__module.block.1.layer.0.layer_norm/aten::pow/Power" type="Power" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="277">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="145" name="Constant_760" type="Const" version="opset1">
<data element_type="i64" shape="1" offset="98629660" size="8" />
<output>
<port id="0" precision="I64" names="278">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="146" name="__module.block.1.layer.0.layer_norm/aten::mean/ReduceMean" type="ReduceMean" version="opset1">
<data keep_dims="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="279,variance.5">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="147" name="Constant_12279" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629668" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="148" name="__module.block.1.layer.0.layer_norm/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="280">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="149" name="__module.block.1.layer.0.layer_norm/aten::rsqrt/Sqrt" type="Sqrt" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="150" name="__module.block.1.layer.0.layer_norm/aten::rsqrt/Divide" type="Divide" version="opset1">
<data auto_broadcast="numpy" m_pythondiv="true" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="281">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="151" name="__module.block.1.layer.0.layer_norm/aten::mul/Multiply" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="282,hidden_states.19">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="152" name="__module.block.1.layer.0.layer_norm/aten::mul/Multiply_1" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="283,285,hidden_states.21">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="153" name="self.block.1.layer.0.SelfAttention.q.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="126949084" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.1.layer.0.SelfAttention.q.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="154" name="__module.block.1.layer.0.SelfAttention.q/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="293,query_states.5">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="155" name="Constant_12620" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="156" name="__module.block.1.layer.0.SelfAttention/aten::view/Reshape" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="295">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="157" name="__module.block.1.layer.0.SelfAttention/aten::transpose/Constant" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="158" name="__module.block.1.layer.0.SelfAttention/aten::transpose/Transpose" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="296,query_states.7">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="159" name="self.block.1.layer.0.SelfAttention.k.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="129308380" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.1.layer.0.SelfAttention.k.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="160" name="__module.block.1.layer.0.SelfAttention.k/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="298,key_states.5">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="161" name="Constant_12621" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="162" name="__module.block.1.layer.0.SelfAttention/aten::view/Reshape_1" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="302">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="163" name="__module.block.1.layer.0.SelfAttention/aten::transpose/Constant_1" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="164" name="__module.block.1.layer.0.SelfAttention/aten::transpose/Transpose_1" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="303,key_states.7">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="165" name="__module.block.1.layer.0.SelfAttention/aten::matmul/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="308_1">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="166" name="__module.block.1.layer.0.SelfAttention/aten::add_/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="308,310,input.25,scores.5">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="167" name="__module.block.1.layer.0.SelfAttention/aten::softmax/Softmax" type="SoftMax" version="opset8">
<data axis="-1" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32" names="311,312,input.27">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="168" name="self.block.1.layer.0.SelfAttention.v.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="131667676" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.1.layer.0.SelfAttention.v.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="169" name="__module.block.1.layer.0.SelfAttention.v/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="300,value_states.5">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="170" name="Constant_12622" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="171" name="__module.block.1.layer.0.SelfAttention/aten::view/Reshape_2" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="305">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="172" name="__module.block.1.layer.0.SelfAttention/aten::transpose/Constant_3" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="173" name="__module.block.1.layer.0.SelfAttention/aten::transpose/Transpose_3" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="306,value_states.7">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="174" name="__module.block.1.layer.0.SelfAttention/aten::matmul/MatMul_1" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="false" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="314,attn_output.5">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="175" name="__module.block.1.layer.0.SelfAttention/aten::transpose/Constant_4" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="176" name="__module.block.1.layer.0.SelfAttention/aten::transpose/Transpose_4" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="315">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="177" name="Constant_12623" type="Const" version="opset1">
<data element_type="i64" shape="3" offset="105709252" size="24" />
<output>
<port id="0" precision="I64">
<dim>3</dim>
</port>
</output>
</layer>
<layer id="178" name="__module.block.1.layer.0.SelfAttention/aten::view/Reshape_3" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I64">
<dim>3</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="318,input.29">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="179" name="self.block.1.layer.0.SelfAttention.o.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="134026972" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.1.layer.0.SelfAttention.o.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="180" name="__module.block.1.layer.0.SelfAttention.o/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="320,input.31">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="181" name="__module.block.1.layer.0/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="322,327,337,hidden_states.23,hidden_states.25">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="182" name="Constant_12285" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 768" offset="136386268" size="3072" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="183" name="Constant_12284" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629652" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="184" name="Constant_12282" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629656" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="185" name="__module.block.1.layer.1.layer_norm/aten::pow/Power" type="Power" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="328">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="186" name="Constant_1043" type="Const" version="opset1">
<data element_type="i64" shape="1" offset="98629660" size="8" />
<output>
<port id="0" precision="I64" names="329">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="187" name="__module.block.1.layer.1.layer_norm/aten::mean/ReduceMean" type="ReduceMean" version="opset1">
<data keep_dims="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="330,variance.7">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="188" name="Constant_12283" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629668" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="189" name="__module.block.1.layer.1.layer_norm/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="331">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="190" name="__module.block.1.layer.1.layer_norm/aten::rsqrt/Sqrt" type="Sqrt" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="191" name="__module.block.1.layer.1.layer_norm/aten::rsqrt/Divide" type="Divide" version="opset1">
<data auto_broadcast="numpy" m_pythondiv="true" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="332">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="192" name="__module.block.1.layer.1.layer_norm/aten::mul/Multiply" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="333,hidden_states.27">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="193" name="__module.block.1.layer.1.layer_norm/aten::mul/Multiply_1" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="334,336,input.33">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="194" name="self.block.1.layer.1.DenseReluDense.wi.weight" type="Const" version="opset1">
<data element_type="f32" shape="3072, 768" offset="136389340" size="9437184" />
<output>
<port id="0" precision="FP32" names="self.block.1.layer.1.DenseReluDense.wi.weight">
<dim>3072</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="195" name="__module.block.1.layer.1.DenseReluDense.wi/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>3072</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="343,input.35">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="196" name="__module.block.1.layer.1.DenseReluDense.act/aten::relu/Relu" type="ReLU" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</input>
<output>
<port id="1" precision="FP32" names="344,input.37">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="197" name="self.block.1.layer.1.DenseReluDense.wo.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 3072" offset="145826524" size="9437184" />
<output>
<port id="0" precision="FP32" names="self.block.1.layer.1.DenseReluDense.wo.weight">
<dim>768</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="198" name="__module.block.1.layer.1.DenseReluDense.wo/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>3072</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="347,input.41">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="199" name="__module.block.1.layer.1/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="349,372,382,hidden_states.29,hidden_states.31">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="200" name="Constant_12289" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 768" offset="155263708" size="3072" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="201" name="Constant_12288" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629652" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="202" name="Constant_12286" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629656" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="203" name="__module.block.2.layer.0.layer_norm/aten::pow/Power" type="Power" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="373">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="204" name="Constant_1122" type="Const" version="opset1">
<data element_type="i64" shape="1" offset="98629660" size="8" />
<output>
<port id="0" precision="I64" names="374">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="205" name="__module.block.2.layer.0.layer_norm/aten::mean/ReduceMean" type="ReduceMean" version="opset1">
<data keep_dims="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="375,variance.9">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="206" name="Constant_12287" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629668" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="207" name="__module.block.2.layer.0.layer_norm/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="376">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="208" name="__module.block.2.layer.0.layer_norm/aten::rsqrt/Sqrt" type="Sqrt" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="209" name="__module.block.2.layer.0.layer_norm/aten::rsqrt/Divide" type="Divide" version="opset1">
<data auto_broadcast="numpy" m_pythondiv="true" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="377">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="210" name="__module.block.2.layer.0.layer_norm/aten::mul/Multiply" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="378,hidden_states.33">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="211" name="__module.block.2.layer.0.layer_norm/aten::mul/Multiply_1" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="379,381,hidden_states.35">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="212" name="self.block.2.layer.0.SelfAttention.q.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="155266780" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.2.layer.0.SelfAttention.q.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="213" name="__module.block.2.layer.0.SelfAttention.q/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="389,query_states.9">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="214" name="Constant_12624" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="215" name="__module.block.2.layer.0.SelfAttention/aten::view/Reshape" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="391">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="216" name="__module.block.2.layer.0.SelfAttention/aten::transpose/Constant" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="217" name="__module.block.2.layer.0.SelfAttention/aten::transpose/Transpose" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="392,query_states.11">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="218" name="self.block.2.layer.0.SelfAttention.k.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="157626076" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.2.layer.0.SelfAttention.k.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="219" name="__module.block.2.layer.0.SelfAttention.k/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="394,key_states.9">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="220" name="Constant_12625" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="221" name="__module.block.2.layer.0.SelfAttention/aten::view/Reshape_1" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="398">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="222" name="__module.block.2.layer.0.SelfAttention/aten::transpose/Constant_1" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="223" name="__module.block.2.layer.0.SelfAttention/aten::transpose/Transpose_1" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="399,key_states.11">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="224" name="__module.block.2.layer.0.SelfAttention/aten::matmul/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="404_1">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="225" name="__module.block.2.layer.0.SelfAttention/aten::add_/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="404,406,input.43,scores.9">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="226" name="__module.block.2.layer.0.SelfAttention/aten::softmax/Softmax" type="SoftMax" version="opset8">
<data axis="-1" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32" names="407,408,input.45">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="227" name="self.block.2.layer.0.SelfAttention.v.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="159985372" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.2.layer.0.SelfAttention.v.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="228" name="__module.block.2.layer.0.SelfAttention.v/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="396,value_states.9">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="229" name="Constant_12626" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="230" name="__module.block.2.layer.0.SelfAttention/aten::view/Reshape_2" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="401">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="231" name="__module.block.2.layer.0.SelfAttention/aten::transpose/Constant_3" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="232" name="__module.block.2.layer.0.SelfAttention/aten::transpose/Transpose_3" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="402,value_states.11">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="233" name="__module.block.2.layer.0.SelfAttention/aten::matmul/MatMul_1" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="false" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="410,attn_output.9">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="234" name="__module.block.2.layer.0.SelfAttention/aten::transpose/Constant_4" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="235" name="__module.block.2.layer.0.SelfAttention/aten::transpose/Transpose_4" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="411">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="236" name="Constant_12627" type="Const" version="opset1">
<data element_type="i64" shape="3" offset="105709252" size="24" />
<output>
<port id="0" precision="I64">
<dim>3</dim>
</port>
</output>
</layer>
<layer id="237" name="__module.block.2.layer.0.SelfAttention/aten::view/Reshape_3" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I64">
<dim>3</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="414,input.47">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="238" name="self.block.2.layer.0.SelfAttention.o.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="162344668" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.2.layer.0.SelfAttention.o.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="239" name="__module.block.2.layer.0.SelfAttention.o/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="416,input.49">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="240" name="__module.block.2.layer.0/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="418,423,433,hidden_states.37,hidden_states.39">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="241" name="Constant_12293" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 768" offset="164703964" size="3072" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="242" name="Constant_12292" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629652" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="243" name="Constant_12290" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629656" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="244" name="__module.block.2.layer.1.layer_norm/aten::pow/Power" type="Power" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="424">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="245" name="Constant_1405" type="Const" version="opset1">
<data element_type="i64" shape="1" offset="98629660" size="8" />
<output>
<port id="0" precision="I64" names="425">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="246" name="__module.block.2.layer.1.layer_norm/aten::mean/ReduceMean" type="ReduceMean" version="opset1">
<data keep_dims="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="426,variance.11">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="247" name="Constant_12291" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629668" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="248" name="__module.block.2.layer.1.layer_norm/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="427">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="249" name="__module.block.2.layer.1.layer_norm/aten::rsqrt/Sqrt" type="Sqrt" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="250" name="__module.block.2.layer.1.layer_norm/aten::rsqrt/Divide" type="Divide" version="opset1">
<data auto_broadcast="numpy" m_pythondiv="true" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="428">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="251" name="__module.block.2.layer.1.layer_norm/aten::mul/Multiply" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="429,hidden_states.41">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="252" name="__module.block.2.layer.1.layer_norm/aten::mul/Multiply_1" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="430,432,input.51">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="253" name="self.block.2.layer.1.DenseReluDense.wi.weight" type="Const" version="opset1">
<data element_type="f32" shape="3072, 768" offset="164707036" size="9437184" />
<output>
<port id="0" precision="FP32" names="self.block.2.layer.1.DenseReluDense.wi.weight">
<dim>3072</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="254" name="__module.block.2.layer.1.DenseReluDense.wi/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>3072</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="439,input.53">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="255" name="__module.block.2.layer.1.DenseReluDense.act/aten::relu/Relu" type="ReLU" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</input>
<output>
<port id="1" precision="FP32" names="440,input.55">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="256" name="self.block.2.layer.1.DenseReluDense.wo.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 3072" offset="174144220" size="9437184" />
<output>
<port id="0" precision="FP32" names="self.block.2.layer.1.DenseReluDense.wo.weight">
<dim>768</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="257" name="__module.block.2.layer.1.DenseReluDense.wo/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>3072</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="443,input.59">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="258" name="__module.block.2.layer.1/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="445,468,478,hidden_states.43,hidden_states.45">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="259" name="Constant_12297" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 768" offset="183581404" size="3072" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="260" name="Constant_12296" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629652" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="261" name="Constant_12294" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629656" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="262" name="__module.block.3.layer.0.layer_norm/aten::pow/Power" type="Power" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="469">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="263" name="Constant_1484" type="Const" version="opset1">
<data element_type="i64" shape="1" offset="98629660" size="8" />
<output>
<port id="0" precision="I64" names="470">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="264" name="__module.block.3.layer.0.layer_norm/aten::mean/ReduceMean" type="ReduceMean" version="opset1">
<data keep_dims="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="471,variance.13">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="265" name="Constant_12295" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629668" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="266" name="__module.block.3.layer.0.layer_norm/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="472">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="267" name="__module.block.3.layer.0.layer_norm/aten::rsqrt/Sqrt" type="Sqrt" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="268" name="__module.block.3.layer.0.layer_norm/aten::rsqrt/Divide" type="Divide" version="opset1">
<data auto_broadcast="numpy" m_pythondiv="true" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="473">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="269" name="__module.block.3.layer.0.layer_norm/aten::mul/Multiply" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="474,hidden_states.47">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="270" name="__module.block.3.layer.0.layer_norm/aten::mul/Multiply_1" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="475,477,hidden_states.49">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="271" name="self.block.3.layer.0.SelfAttention.q.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="183584476" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.3.layer.0.SelfAttention.q.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="272" name="__module.block.3.layer.0.SelfAttention.q/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="485,query_states.13">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="273" name="Constant_12628" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="274" name="__module.block.3.layer.0.SelfAttention/aten::view/Reshape" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="487">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="275" name="__module.block.3.layer.0.SelfAttention/aten::transpose/Constant" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="276" name="__module.block.3.layer.0.SelfAttention/aten::transpose/Transpose" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="488,query_states.15">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="277" name="self.block.3.layer.0.SelfAttention.k.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="185943772" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.3.layer.0.SelfAttention.k.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="278" name="__module.block.3.layer.0.SelfAttention.k/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="490,key_states.13">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="279" name="Constant_12629" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="280" name="__module.block.3.layer.0.SelfAttention/aten::view/Reshape_1" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="494">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="281" name="__module.block.3.layer.0.SelfAttention/aten::transpose/Constant_1" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="282" name="__module.block.3.layer.0.SelfAttention/aten::transpose/Transpose_1" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="495,key_states.15">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="283" name="__module.block.3.layer.0.SelfAttention/aten::matmul/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="500_1">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="284" name="__module.block.3.layer.0.SelfAttention/aten::add_/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="500,502,input.61,scores.13">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="285" name="__module.block.3.layer.0.SelfAttention/aten::softmax/Softmax" type="SoftMax" version="opset8">
<data axis="-1" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32" names="503,504,input.63">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="286" name="self.block.3.layer.0.SelfAttention.v.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="188303068" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.3.layer.0.SelfAttention.v.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="287" name="__module.block.3.layer.0.SelfAttention.v/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="492,value_states.13">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="288" name="Constant_12630" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="289" name="__module.block.3.layer.0.SelfAttention/aten::view/Reshape_2" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="497">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="290" name="__module.block.3.layer.0.SelfAttention/aten::transpose/Constant_3" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="291" name="__module.block.3.layer.0.SelfAttention/aten::transpose/Transpose_3" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="498,value_states.15">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="292" name="__module.block.3.layer.0.SelfAttention/aten::matmul/MatMul_1" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="false" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="506,attn_output.13">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="293" name="__module.block.3.layer.0.SelfAttention/aten::transpose/Constant_4" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="294" name="__module.block.3.layer.0.SelfAttention/aten::transpose/Transpose_4" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="507">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="295" name="Constant_12631" type="Const" version="opset1">
<data element_type="i64" shape="3" offset="105709252" size="24" />
<output>
<port id="0" precision="I64">
<dim>3</dim>
</port>
</output>
</layer>
<layer id="296" name="__module.block.3.layer.0.SelfAttention/aten::view/Reshape_3" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I64">
<dim>3</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="510,input.65">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="297" name="self.block.3.layer.0.SelfAttention.o.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="190662364" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.3.layer.0.SelfAttention.o.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="298" name="__module.block.3.layer.0.SelfAttention.o/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="512,input.67">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="299" name="__module.block.3.layer.0/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="514,519,529,hidden_states.51,hidden_states.53">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="300" name="Constant_12301" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 768" offset="193021660" size="3072" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="301" name="Constant_12300" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629652" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="302" name="Constant_12298" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629656" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="303" name="__module.block.3.layer.1.layer_norm/aten::pow/Power" type="Power" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="520">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="304" name="Constant_1767" type="Const" version="opset1">
<data element_type="i64" shape="1" offset="98629660" size="8" />
<output>
<port id="0" precision="I64" names="521">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="305" name="__module.block.3.layer.1.layer_norm/aten::mean/ReduceMean" type="ReduceMean" version="opset1">
<data keep_dims="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="522,variance.15">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="306" name="Constant_12299" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629668" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="307" name="__module.block.3.layer.1.layer_norm/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="523">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="308" name="__module.block.3.layer.1.layer_norm/aten::rsqrt/Sqrt" type="Sqrt" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="309" name="__module.block.3.layer.1.layer_norm/aten::rsqrt/Divide" type="Divide" version="opset1">
<data auto_broadcast="numpy" m_pythondiv="true" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="524">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="310" name="__module.block.3.layer.1.layer_norm/aten::mul/Multiply" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="525,hidden_states.55">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="311" name="__module.block.3.layer.1.layer_norm/aten::mul/Multiply_1" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="526,528,input.69">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="312" name="self.block.3.layer.1.DenseReluDense.wi.weight" type="Const" version="opset1">
<data element_type="f32" shape="3072, 768" offset="193024732" size="9437184" />
<output>
<port id="0" precision="FP32" names="self.block.3.layer.1.DenseReluDense.wi.weight">
<dim>3072</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="313" name="__module.block.3.layer.1.DenseReluDense.wi/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>3072</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="535,input.71">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="314" name="__module.block.3.layer.1.DenseReluDense.act/aten::relu/Relu" type="ReLU" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</input>
<output>
<port id="1" precision="FP32" names="536,input.73">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="315" name="self.block.3.layer.1.DenseReluDense.wo.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 3072" offset="202461916" size="9437184" />
<output>
<port id="0" precision="FP32" names="self.block.3.layer.1.DenseReluDense.wo.weight">
<dim>768</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="316" name="__module.block.3.layer.1.DenseReluDense.wo/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>3072</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="539,input.77">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="317" name="__module.block.3.layer.1/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="541,564,574,hidden_states.57,hidden_states.59">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="318" name="Constant_12305" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 768" offset="211899100" size="3072" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="319" name="Constant_12304" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629652" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="320" name="Constant_12302" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629656" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="321" name="__module.block.4.layer.0.layer_norm/aten::pow/Power" type="Power" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="565">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="322" name="Constant_1846" type="Const" version="opset1">
<data element_type="i64" shape="1" offset="98629660" size="8" />
<output>
<port id="0" precision="I64" names="566">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="323" name="__module.block.4.layer.0.layer_norm/aten::mean/ReduceMean" type="ReduceMean" version="opset1">
<data keep_dims="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="567,variance.17">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="324" name="Constant_12303" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629668" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="325" name="__module.block.4.layer.0.layer_norm/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="568">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="326" name="__module.block.4.layer.0.layer_norm/aten::rsqrt/Sqrt" type="Sqrt" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="327" name="__module.block.4.layer.0.layer_norm/aten::rsqrt/Divide" type="Divide" version="opset1">
<data auto_broadcast="numpy" m_pythondiv="true" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="569">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="328" name="__module.block.4.layer.0.layer_norm/aten::mul/Multiply" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="570,hidden_states.61">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="329" name="__module.block.4.layer.0.layer_norm/aten::mul/Multiply_1" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="571,573,hidden_states.63">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="330" name="self.block.4.layer.0.SelfAttention.q.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="211902172" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.4.layer.0.SelfAttention.q.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="331" name="__module.block.4.layer.0.SelfAttention.q/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="581,query_states.17">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="332" name="Constant_12632" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="333" name="__module.block.4.layer.0.SelfAttention/aten::view/Reshape" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="583">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="334" name="__module.block.4.layer.0.SelfAttention/aten::transpose/Constant" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="335" name="__module.block.4.layer.0.SelfAttention/aten::transpose/Transpose" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="584,query_states.19">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="336" name="self.block.4.layer.0.SelfAttention.k.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="214261468" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.4.layer.0.SelfAttention.k.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="337" name="__module.block.4.layer.0.SelfAttention.k/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="586,key_states.17">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="338" name="Constant_12633" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="339" name="__module.block.4.layer.0.SelfAttention/aten::view/Reshape_1" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="590">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="340" name="__module.block.4.layer.0.SelfAttention/aten::transpose/Constant_1" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="341" name="__module.block.4.layer.0.SelfAttention/aten::transpose/Transpose_1" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="591,key_states.19">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="342" name="__module.block.4.layer.0.SelfAttention/aten::matmul/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="596_1">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="343" name="__module.block.4.layer.0.SelfAttention/aten::add_/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="596,598,input.79,scores.17">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="344" name="__module.block.4.layer.0.SelfAttention/aten::softmax/Softmax" type="SoftMax" version="opset8">
<data axis="-1" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32" names="599,600,input.81">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="345" name="self.block.4.layer.0.SelfAttention.v.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="216620764" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.4.layer.0.SelfAttention.v.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="346" name="__module.block.4.layer.0.SelfAttention.v/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="588,value_states.17">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="347" name="Constant_12634" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="348" name="__module.block.4.layer.0.SelfAttention/aten::view/Reshape_2" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="593">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="349" name="__module.block.4.layer.0.SelfAttention/aten::transpose/Constant_3" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="350" name="__module.block.4.layer.0.SelfAttention/aten::transpose/Transpose_3" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="594,value_states.19">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="351" name="__module.block.4.layer.0.SelfAttention/aten::matmul/MatMul_1" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="false" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="602,attn_output.17">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="352" name="__module.block.4.layer.0.SelfAttention/aten::transpose/Constant_4" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="353" name="__module.block.4.layer.0.SelfAttention/aten::transpose/Transpose_4" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="603">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="354" name="Constant_12635" type="Const" version="opset1">
<data element_type="i64" shape="3" offset="105709252" size="24" />
<output>
<port id="0" precision="I64">
<dim>3</dim>
</port>
</output>
</layer>
<layer id="355" name="__module.block.4.layer.0.SelfAttention/aten::view/Reshape_3" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I64">
<dim>3</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="606,input.83">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="356" name="self.block.4.layer.0.SelfAttention.o.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="218980060" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.4.layer.0.SelfAttention.o.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="357" name="__module.block.4.layer.0.SelfAttention.o/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="608,input.85">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="358" name="__module.block.4.layer.0/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="610,615,625,hidden_states.65,hidden_states.67">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="359" name="Constant_12309" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 768" offset="221339356" size="3072" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="360" name="Constant_12308" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629652" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="361" name="Constant_12306" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629656" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="362" name="__module.block.4.layer.1.layer_norm/aten::pow/Power" type="Power" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="616">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="363" name="Constant_2129" type="Const" version="opset1">
<data element_type="i64" shape="1" offset="98629660" size="8" />
<output>
<port id="0" precision="I64" names="617">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="364" name="__module.block.4.layer.1.layer_norm/aten::mean/ReduceMean" type="ReduceMean" version="opset1">
<data keep_dims="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="618,variance.19">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="365" name="Constant_12307" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629668" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="366" name="__module.block.4.layer.1.layer_norm/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="619">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="367" name="__module.block.4.layer.1.layer_norm/aten::rsqrt/Sqrt" type="Sqrt" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="368" name="__module.block.4.layer.1.layer_norm/aten::rsqrt/Divide" type="Divide" version="opset1">
<data auto_broadcast="numpy" m_pythondiv="true" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="620">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="369" name="__module.block.4.layer.1.layer_norm/aten::mul/Multiply" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="621,hidden_states.69">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="370" name="__module.block.4.layer.1.layer_norm/aten::mul/Multiply_1" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="622,624,input.87">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="371" name="self.block.4.layer.1.DenseReluDense.wi.weight" type="Const" version="opset1">
<data element_type="f32" shape="3072, 768" offset="221342428" size="9437184" />
<output>
<port id="0" precision="FP32" names="self.block.4.layer.1.DenseReluDense.wi.weight">
<dim>3072</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="372" name="__module.block.4.layer.1.DenseReluDense.wi/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>3072</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="631,input.89">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="373" name="__module.block.4.layer.1.DenseReluDense.act/aten::relu/Relu" type="ReLU" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</input>
<output>
<port id="1" precision="FP32" names="632,input.91">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="374" name="self.block.4.layer.1.DenseReluDense.wo.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 3072" offset="230779612" size="9437184" />
<output>
<port id="0" precision="FP32" names="self.block.4.layer.1.DenseReluDense.wo.weight">
<dim>768</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="375" name="__module.block.4.layer.1.DenseReluDense.wo/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>3072</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="635,input.95">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="376" name="__module.block.4.layer.1/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="637,660,670,hidden_states.71,hidden_states.73">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="377" name="Constant_12313" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 768" offset="240216796" size="3072" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="378" name="Constant_12312" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629652" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="379" name="Constant_12310" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629656" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="380" name="__module.block.5.layer.0.layer_norm/aten::pow/Power" type="Power" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="661">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="381" name="Constant_2208" type="Const" version="opset1">
<data element_type="i64" shape="1" offset="98629660" size="8" />
<output>
<port id="0" precision="I64" names="662">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="382" name="__module.block.5.layer.0.layer_norm/aten::mean/ReduceMean" type="ReduceMean" version="opset1">
<data keep_dims="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="663,variance.21">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="383" name="Constant_12311" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629668" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="384" name="__module.block.5.layer.0.layer_norm/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="664">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="385" name="__module.block.5.layer.0.layer_norm/aten::rsqrt/Sqrt" type="Sqrt" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="386" name="__module.block.5.layer.0.layer_norm/aten::rsqrt/Divide" type="Divide" version="opset1">
<data auto_broadcast="numpy" m_pythondiv="true" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="665">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="387" name="__module.block.5.layer.0.layer_norm/aten::mul/Multiply" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="666,hidden_states.75">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="388" name="__module.block.5.layer.0.layer_norm/aten::mul/Multiply_1" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="667,669,hidden_states.77">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="389" name="self.block.5.layer.0.SelfAttention.q.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="240219868" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.5.layer.0.SelfAttention.q.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="390" name="__module.block.5.layer.0.SelfAttention.q/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="677,query_states.21">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="391" name="Constant_12636" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="392" name="__module.block.5.layer.0.SelfAttention/aten::view/Reshape" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="679">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="393" name="__module.block.5.layer.0.SelfAttention/aten::transpose/Constant" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="394" name="__module.block.5.layer.0.SelfAttention/aten::transpose/Transpose" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="680,query_states.23">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="395" name="self.block.5.layer.0.SelfAttention.k.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="242579164" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.5.layer.0.SelfAttention.k.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="396" name="__module.block.5.layer.0.SelfAttention.k/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="682,key_states.21">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="397" name="Constant_12637" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="398" name="__module.block.5.layer.0.SelfAttention/aten::view/Reshape_1" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="686">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="399" name="__module.block.5.layer.0.SelfAttention/aten::transpose/Constant_1" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="400" name="__module.block.5.layer.0.SelfAttention/aten::transpose/Transpose_1" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="687,key_states.23">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="401" name="__module.block.5.layer.0.SelfAttention/aten::matmul/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="692_1">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="402" name="__module.block.5.layer.0.SelfAttention/aten::add_/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="692,694,input.97,scores.21">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="403" name="__module.block.5.layer.0.SelfAttention/aten::softmax/Softmax" type="SoftMax" version="opset8">
<data axis="-1" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32" names="695,696,input.99">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="404" name="self.block.5.layer.0.SelfAttention.v.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="244938460" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.5.layer.0.SelfAttention.v.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="405" name="__module.block.5.layer.0.SelfAttention.v/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="684,value_states.21">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="406" name="Constant_12638" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="407" name="__module.block.5.layer.0.SelfAttention/aten::view/Reshape_2" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="689">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="408" name="__module.block.5.layer.0.SelfAttention/aten::transpose/Constant_3" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="409" name="__module.block.5.layer.0.SelfAttention/aten::transpose/Transpose_3" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="690,value_states.23">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="410" name="__module.block.5.layer.0.SelfAttention/aten::matmul/MatMul_1" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="false" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="698,attn_output.21">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="411" name="__module.block.5.layer.0.SelfAttention/aten::transpose/Constant_4" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="412" name="__module.block.5.layer.0.SelfAttention/aten::transpose/Transpose_4" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="699">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="413" name="Constant_12639" type="Const" version="opset1">
<data element_type="i64" shape="3" offset="105709252" size="24" />
<output>
<port id="0" precision="I64">
<dim>3</dim>
</port>
</output>
</layer>
<layer id="414" name="__module.block.5.layer.0.SelfAttention/aten::view/Reshape_3" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I64">
<dim>3</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="702,input.101">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="415" name="self.block.5.layer.0.SelfAttention.o.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="247297756" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.5.layer.0.SelfAttention.o.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="416" name="__module.block.5.layer.0.SelfAttention.o/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="704,input.103">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="417" name="__module.block.5.layer.0/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="706,711,721,hidden_states.79,hidden_states.81">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="418" name="Constant_12317" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 768" offset="249657052" size="3072" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="419" name="Constant_12316" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629652" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="420" name="Constant_12314" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629656" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="421" name="__module.block.5.layer.1.layer_norm/aten::pow/Power" type="Power" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="712">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="422" name="Constant_2491" type="Const" version="opset1">
<data element_type="i64" shape="1" offset="98629660" size="8" />
<output>
<port id="0" precision="I64" names="713">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="423" name="__module.block.5.layer.1.layer_norm/aten::mean/ReduceMean" type="ReduceMean" version="opset1">
<data keep_dims="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="714,variance.23">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="424" name="Constant_12315" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629668" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="425" name="__module.block.5.layer.1.layer_norm/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="715">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="426" name="__module.block.5.layer.1.layer_norm/aten::rsqrt/Sqrt" type="Sqrt" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="427" name="__module.block.5.layer.1.layer_norm/aten::rsqrt/Divide" type="Divide" version="opset1">
<data auto_broadcast="numpy" m_pythondiv="true" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="716">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="428" name="__module.block.5.layer.1.layer_norm/aten::mul/Multiply" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="717,hidden_states.83">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="429" name="__module.block.5.layer.1.layer_norm/aten::mul/Multiply_1" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="718,720,input.105">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="430" name="self.block.5.layer.1.DenseReluDense.wi.weight" type="Const" version="opset1">
<data element_type="f32" shape="3072, 768" offset="249660124" size="9437184" />
<output>
<port id="0" precision="FP32" names="self.block.5.layer.1.DenseReluDense.wi.weight">
<dim>3072</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="431" name="__module.block.5.layer.1.DenseReluDense.wi/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>3072</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="727,input.107">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="432" name="__module.block.5.layer.1.DenseReluDense.act/aten::relu/Relu" type="ReLU" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</input>
<output>
<port id="1" precision="FP32" names="728,input.109">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="433" name="self.block.5.layer.1.DenseReluDense.wo.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 3072" offset="259097308" size="9437184" />
<output>
<port id="0" precision="FP32" names="self.block.5.layer.1.DenseReluDense.wo.weight">
<dim>768</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="434" name="__module.block.5.layer.1.DenseReluDense.wo/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>3072</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="731,input.113">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="435" name="__module.block.5.layer.1/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="733,756,766,hidden_states.85,hidden_states.87">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="436" name="Constant_12321" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 768" offset="268534492" size="3072" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="437" name="Constant_12320" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629652" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="438" name="Constant_12318" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629656" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="439" name="__module.block.6.layer.0.layer_norm/aten::pow/Power" type="Power" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="757">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="440" name="Constant_2570" type="Const" version="opset1">
<data element_type="i64" shape="1" offset="98629660" size="8" />
<output>
<port id="0" precision="I64" names="758">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="441" name="__module.block.6.layer.0.layer_norm/aten::mean/ReduceMean" type="ReduceMean" version="opset1">
<data keep_dims="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="759,variance.25">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="442" name="Constant_12319" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629668" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="443" name="__module.block.6.layer.0.layer_norm/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="760">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="444" name="__module.block.6.layer.0.layer_norm/aten::rsqrt/Sqrt" type="Sqrt" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="445" name="__module.block.6.layer.0.layer_norm/aten::rsqrt/Divide" type="Divide" version="opset1">
<data auto_broadcast="numpy" m_pythondiv="true" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="761">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="446" name="__module.block.6.layer.0.layer_norm/aten::mul/Multiply" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="762,hidden_states.89">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="447" name="__module.block.6.layer.0.layer_norm/aten::mul/Multiply_1" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="763,765,hidden_states.91">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="448" name="self.block.6.layer.0.SelfAttention.q.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="268537564" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.6.layer.0.SelfAttention.q.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="449" name="__module.block.6.layer.0.SelfAttention.q/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="773,query_states.25">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="450" name="Constant_12640" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="451" name="__module.block.6.layer.0.SelfAttention/aten::view/Reshape" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="775">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="452" name="__module.block.6.layer.0.SelfAttention/aten::transpose/Constant" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="453" name="__module.block.6.layer.0.SelfAttention/aten::transpose/Transpose" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="776,query_states.27">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="454" name="self.block.6.layer.0.SelfAttention.k.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="270896860" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.6.layer.0.SelfAttention.k.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="455" name="__module.block.6.layer.0.SelfAttention.k/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="778,key_states.25">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="456" name="Constant_12641" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="457" name="__module.block.6.layer.0.SelfAttention/aten::view/Reshape_1" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="782">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="458" name="__module.block.6.layer.0.SelfAttention/aten::transpose/Constant_1" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="459" name="__module.block.6.layer.0.SelfAttention/aten::transpose/Transpose_1" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="783,key_states.27">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="460" name="__module.block.6.layer.0.SelfAttention/aten::matmul/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="788_1">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="461" name="__module.block.6.layer.0.SelfAttention/aten::add_/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="788,790,input.115,scores.25">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="462" name="__module.block.6.layer.0.SelfAttention/aten::softmax/Softmax" type="SoftMax" version="opset8">
<data axis="-1" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32" names="791,792,input.117">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="463" name="self.block.6.layer.0.SelfAttention.v.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="273256156" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.6.layer.0.SelfAttention.v.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="464" name="__module.block.6.layer.0.SelfAttention.v/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="780,value_states.25">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="465" name="Constant_12642" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="466" name="__module.block.6.layer.0.SelfAttention/aten::view/Reshape_2" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="785">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="467" name="__module.block.6.layer.0.SelfAttention/aten::transpose/Constant_3" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="468" name="__module.block.6.layer.0.SelfAttention/aten::transpose/Transpose_3" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="786,value_states.27">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="469" name="__module.block.6.layer.0.SelfAttention/aten::matmul/MatMul_1" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="false" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="794,attn_output.25">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="470" name="__module.block.6.layer.0.SelfAttention/aten::transpose/Constant_4" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="471" name="__module.block.6.layer.0.SelfAttention/aten::transpose/Transpose_4" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="795">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="472" name="Constant_12643" type="Const" version="opset1">
<data element_type="i64" shape="3" offset="105709252" size="24" />
<output>
<port id="0" precision="I64">
<dim>3</dim>
</port>
</output>
</layer>
<layer id="473" name="__module.block.6.layer.0.SelfAttention/aten::view/Reshape_3" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I64">
<dim>3</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="798,input.119">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="474" name="self.block.6.layer.0.SelfAttention.o.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="275615452" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.6.layer.0.SelfAttention.o.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="475" name="__module.block.6.layer.0.SelfAttention.o/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="800,input.121">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="476" name="__module.block.6.layer.0/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="802,807,817,hidden_states.93,hidden_states.95">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="477" name="Constant_12325" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 768" offset="277974748" size="3072" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="478" name="Constant_12324" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629652" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="479" name="Constant_12322" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629656" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="480" name="__module.block.6.layer.1.layer_norm/aten::pow/Power" type="Power" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="808">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="481" name="Constant_2853" type="Const" version="opset1">
<data element_type="i64" shape="1" offset="98629660" size="8" />
<output>
<port id="0" precision="I64" names="809">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="482" name="__module.block.6.layer.1.layer_norm/aten::mean/ReduceMean" type="ReduceMean" version="opset1">
<data keep_dims="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="810,variance.27">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="483" name="Constant_12323" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629668" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="484" name="__module.block.6.layer.1.layer_norm/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="811">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="485" name="__module.block.6.layer.1.layer_norm/aten::rsqrt/Sqrt" type="Sqrt" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="486" name="__module.block.6.layer.1.layer_norm/aten::rsqrt/Divide" type="Divide" version="opset1">
<data auto_broadcast="numpy" m_pythondiv="true" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="812">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="487" name="__module.block.6.layer.1.layer_norm/aten::mul/Multiply" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="813,hidden_states.97">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="488" name="__module.block.6.layer.1.layer_norm/aten::mul/Multiply_1" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="814,816,input.123">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="489" name="self.block.6.layer.1.DenseReluDense.wi.weight" type="Const" version="opset1">
<data element_type="f32" shape="3072, 768" offset="277977820" size="9437184" />
<output>
<port id="0" precision="FP32" names="self.block.6.layer.1.DenseReluDense.wi.weight">
<dim>3072</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="490" name="__module.block.6.layer.1.DenseReluDense.wi/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>3072</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="823,input.125">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="491" name="__module.block.6.layer.1.DenseReluDense.act/aten::relu/Relu" type="ReLU" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</input>
<output>
<port id="1" precision="FP32" names="824,input.127">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="492" name="self.block.6.layer.1.DenseReluDense.wo.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 3072" offset="287415004" size="9437184" />
<output>
<port id="0" precision="FP32" names="self.block.6.layer.1.DenseReluDense.wo.weight">
<dim>768</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="493" name="__module.block.6.layer.1.DenseReluDense.wo/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>3072</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="827,input.131">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="494" name="__module.block.6.layer.1/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="829,852,862,hidden_states.101,hidden_states.99">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="495" name="Constant_12329" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 768" offset="296852188" size="3072" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="496" name="Constant_12328" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629652" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="497" name="Constant_12326" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629656" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="498" name="__module.block.7.layer.0.layer_norm/aten::pow/Power" type="Power" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="853">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="499" name="Constant_2932" type="Const" version="opset1">
<data element_type="i64" shape="1" offset="98629660" size="8" />
<output>
<port id="0" precision="I64" names="854">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="500" name="__module.block.7.layer.0.layer_norm/aten::mean/ReduceMean" type="ReduceMean" version="opset1">
<data keep_dims="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="855,variance.29">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="501" name="Constant_12327" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629668" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="502" name="__module.block.7.layer.0.layer_norm/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="856">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="503" name="__module.block.7.layer.0.layer_norm/aten::rsqrt/Sqrt" type="Sqrt" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="504" name="__module.block.7.layer.0.layer_norm/aten::rsqrt/Divide" type="Divide" version="opset1">
<data auto_broadcast="numpy" m_pythondiv="true" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="857">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="505" name="__module.block.7.layer.0.layer_norm/aten::mul/Multiply" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="858,hidden_states.103">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="506" name="__module.block.7.layer.0.layer_norm/aten::mul/Multiply_1" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="859,861,hidden_states.105">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="507" name="self.block.7.layer.0.SelfAttention.q.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="296855260" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.7.layer.0.SelfAttention.q.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="508" name="__module.block.7.layer.0.SelfAttention.q/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="869,query_states.29">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="509" name="Constant_12644" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="510" name="__module.block.7.layer.0.SelfAttention/aten::view/Reshape" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="871">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="511" name="__module.block.7.layer.0.SelfAttention/aten::transpose/Constant" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="512" name="__module.block.7.layer.0.SelfAttention/aten::transpose/Transpose" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="872,query_states.31">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="513" name="self.block.7.layer.0.SelfAttention.k.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="299214556" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.7.layer.0.SelfAttention.k.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="514" name="__module.block.7.layer.0.SelfAttention.k/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="874,key_states.29">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="515" name="Constant_12645" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="516" name="__module.block.7.layer.0.SelfAttention/aten::view/Reshape_1" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="878">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="517" name="__module.block.7.layer.0.SelfAttention/aten::transpose/Constant_1" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="518" name="__module.block.7.layer.0.SelfAttention/aten::transpose/Transpose_1" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="879,key_states.31">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="519" name="__module.block.7.layer.0.SelfAttention/aten::matmul/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="884_1">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="520" name="__module.block.7.layer.0.SelfAttention/aten::add_/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="884,886,input.133,scores.29">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="521" name="__module.block.7.layer.0.SelfAttention/aten::softmax/Softmax" type="SoftMax" version="opset8">
<data axis="-1" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32" names="887,888,input.135">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="522" name="self.block.7.layer.0.SelfAttention.v.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="301573852" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.7.layer.0.SelfAttention.v.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="523" name="__module.block.7.layer.0.SelfAttention.v/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="876,value_states.29">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="524" name="Constant_12646" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="525" name="__module.block.7.layer.0.SelfAttention/aten::view/Reshape_2" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="881">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="526" name="__module.block.7.layer.0.SelfAttention/aten::transpose/Constant_3" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="527" name="__module.block.7.layer.0.SelfAttention/aten::transpose/Transpose_3" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="882,value_states.31">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="528" name="__module.block.7.layer.0.SelfAttention/aten::matmul/MatMul_1" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="false" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="890,attn_output.29">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="529" name="__module.block.7.layer.0.SelfAttention/aten::transpose/Constant_4" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="530" name="__module.block.7.layer.0.SelfAttention/aten::transpose/Transpose_4" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="891">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="531" name="Constant_12647" type="Const" version="opset1">
<data element_type="i64" shape="3" offset="105709252" size="24" />
<output>
<port id="0" precision="I64">
<dim>3</dim>
</port>
</output>
</layer>
<layer id="532" name="__module.block.7.layer.0.SelfAttention/aten::view/Reshape_3" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I64">
<dim>3</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="894,input.137">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="533" name="self.block.7.layer.0.SelfAttention.o.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="303933148" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.7.layer.0.SelfAttention.o.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="534" name="__module.block.7.layer.0.SelfAttention.o/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="896,input.139">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="535" name="__module.block.7.layer.0/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="898,903,913,hidden_states.107,hidden_states.109">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="536" name="Constant_12333" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 768" offset="306292444" size="3072" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="537" name="Constant_12332" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629652" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="538" name="Constant_12330" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629656" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="539" name="__module.block.7.layer.1.layer_norm/aten::pow/Power" type="Power" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="904">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="540" name="Constant_3215" type="Const" version="opset1">
<data element_type="i64" shape="1" offset="98629660" size="8" />
<output>
<port id="0" precision="I64" names="905">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="541" name="__module.block.7.layer.1.layer_norm/aten::mean/ReduceMean" type="ReduceMean" version="opset1">
<data keep_dims="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="906,variance.31">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="542" name="Constant_12331" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629668" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="543" name="__module.block.7.layer.1.layer_norm/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="907">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="544" name="__module.block.7.layer.1.layer_norm/aten::rsqrt/Sqrt" type="Sqrt" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="545" name="__module.block.7.layer.1.layer_norm/aten::rsqrt/Divide" type="Divide" version="opset1">
<data auto_broadcast="numpy" m_pythondiv="true" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="908">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="546" name="__module.block.7.layer.1.layer_norm/aten::mul/Multiply" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="909,hidden_states.111">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="547" name="__module.block.7.layer.1.layer_norm/aten::mul/Multiply_1" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="910,912,input.141">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="548" name="self.block.7.layer.1.DenseReluDense.wi.weight" type="Const" version="opset1">
<data element_type="f32" shape="3072, 768" offset="306295516" size="9437184" />
<output>
<port id="0" precision="FP32" names="self.block.7.layer.1.DenseReluDense.wi.weight">
<dim>3072</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="549" name="__module.block.7.layer.1.DenseReluDense.wi/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>3072</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="919,input.143">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="550" name="__module.block.7.layer.1.DenseReluDense.act/aten::relu/Relu" type="ReLU" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</input>
<output>
<port id="1" precision="FP32" names="920,input.145">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="551" name="self.block.7.layer.1.DenseReluDense.wo.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 3072" offset="315732700" size="9437184" />
<output>
<port id="0" precision="FP32" names="self.block.7.layer.1.DenseReluDense.wo.weight">
<dim>768</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="552" name="__module.block.7.layer.1.DenseReluDense.wo/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>3072</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="923,input.149">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="553" name="__module.block.7.layer.1/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="925,948,958,hidden_states.113,hidden_states.115">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="554" name="Constant_12337" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 768" offset="325169884" size="3072" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="555" name="Constant_12336" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629652" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="556" name="Constant_12334" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629656" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="557" name="__module.block.8.layer.0.layer_norm/aten::pow/Power" type="Power" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="949">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="558" name="Constant_3294" type="Const" version="opset1">
<data element_type="i64" shape="1" offset="98629660" size="8" />
<output>
<port id="0" precision="I64" names="950">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="559" name="__module.block.8.layer.0.layer_norm/aten::mean/ReduceMean" type="ReduceMean" version="opset1">
<data keep_dims="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="951,variance.33">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="560" name="Constant_12335" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629668" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="561" name="__module.block.8.layer.0.layer_norm/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="952">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="562" name="__module.block.8.layer.0.layer_norm/aten::rsqrt/Sqrt" type="Sqrt" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="563" name="__module.block.8.layer.0.layer_norm/aten::rsqrt/Divide" type="Divide" version="opset1">
<data auto_broadcast="numpy" m_pythondiv="true" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="953">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="564" name="__module.block.8.layer.0.layer_norm/aten::mul/Multiply" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="954,hidden_states.117">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="565" name="__module.block.8.layer.0.layer_norm/aten::mul/Multiply_1" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="955,957,hidden_states.119">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="566" name="self.block.8.layer.0.SelfAttention.q.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="325172956" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.8.layer.0.SelfAttention.q.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="567" name="__module.block.8.layer.0.SelfAttention.q/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="965,query_states.33">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="568" name="Constant_12648" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="569" name="__module.block.8.layer.0.SelfAttention/aten::view/Reshape" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="967">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="570" name="__module.block.8.layer.0.SelfAttention/aten::transpose/Constant" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="571" name="__module.block.8.layer.0.SelfAttention/aten::transpose/Transpose" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="968,query_states.35">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="572" name="self.block.8.layer.0.SelfAttention.k.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="327532252" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.8.layer.0.SelfAttention.k.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="573" name="__module.block.8.layer.0.SelfAttention.k/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="970,key_states.33">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="574" name="Constant_12649" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="575" name="__module.block.8.layer.0.SelfAttention/aten::view/Reshape_1" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="974">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="576" name="__module.block.8.layer.0.SelfAttention/aten::transpose/Constant_1" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="577" name="__module.block.8.layer.0.SelfAttention/aten::transpose/Transpose_1" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="975,key_states.35">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="578" name="__module.block.8.layer.0.SelfAttention/aten::matmul/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="980_1">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="579" name="__module.block.8.layer.0.SelfAttention/aten::add_/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="980,982,input.151,scores.33">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="580" name="__module.block.8.layer.0.SelfAttention/aten::softmax/Softmax" type="SoftMax" version="opset8">
<data axis="-1" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32" names="983,984,input.153">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="581" name="self.block.8.layer.0.SelfAttention.v.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="329891548" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.8.layer.0.SelfAttention.v.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="582" name="__module.block.8.layer.0.SelfAttention.v/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="972,value_states.33">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="583" name="Constant_12650" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="584" name="__module.block.8.layer.0.SelfAttention/aten::view/Reshape_2" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="977">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="585" name="__module.block.8.layer.0.SelfAttention/aten::transpose/Constant_3" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="586" name="__module.block.8.layer.0.SelfAttention/aten::transpose/Transpose_3" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="978,value_states.35">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="587" name="__module.block.8.layer.0.SelfAttention/aten::matmul/MatMul_1" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="false" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="986,attn_output.33">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="588" name="__module.block.8.layer.0.SelfAttention/aten::transpose/Constant_4" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="589" name="__module.block.8.layer.0.SelfAttention/aten::transpose/Transpose_4" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="987">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="590" name="Constant_12651" type="Const" version="opset1">
<data element_type="i64" shape="3" offset="105709252" size="24" />
<output>
<port id="0" precision="I64">
<dim>3</dim>
</port>
</output>
</layer>
<layer id="591" name="__module.block.8.layer.0.SelfAttention/aten::view/Reshape_3" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I64">
<dim>3</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="990,input.155">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="592" name="self.block.8.layer.0.SelfAttention.o.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="332250844" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.8.layer.0.SelfAttention.o.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="593" name="__module.block.8.layer.0.SelfAttention.o/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="992,input.157">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="594" name="__module.block.8.layer.0/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1009,994,999,hidden_states.121,hidden_states.123">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="595" name="Constant_12341" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 768" offset="334610140" size="3072" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="596" name="Constant_12340" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629652" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="597" name="Constant_12338" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629656" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="598" name="__module.block.8.layer.1.layer_norm/aten::pow/Power" type="Power" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1000">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="599" name="Constant_3577" type="Const" version="opset1">
<data element_type="i64" shape="1" offset="98629660" size="8" />
<output>
<port id="0" precision="I64" names="1001">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="600" name="__module.block.8.layer.1.layer_norm/aten::mean/ReduceMean" type="ReduceMean" version="opset1">
<data keep_dims="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1002,variance.35">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="601" name="Constant_12339" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629668" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="602" name="__module.block.8.layer.1.layer_norm/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1003">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="603" name="__module.block.8.layer.1.layer_norm/aten::rsqrt/Sqrt" type="Sqrt" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="604" name="__module.block.8.layer.1.layer_norm/aten::rsqrt/Divide" type="Divide" version="opset1">
<data auto_broadcast="numpy" m_pythondiv="true" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1004">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="605" name="__module.block.8.layer.1.layer_norm/aten::mul/Multiply" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1005,hidden_states.125">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="606" name="__module.block.8.layer.1.layer_norm/aten::mul/Multiply_1" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1006,1008,input.159">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="607" name="self.block.8.layer.1.DenseReluDense.wi.weight" type="Const" version="opset1">
<data element_type="f32" shape="3072, 768" offset="334613212" size="9437184" />
<output>
<port id="0" precision="FP32" names="self.block.8.layer.1.DenseReluDense.wi.weight">
<dim>3072</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="608" name="__module.block.8.layer.1.DenseReluDense.wi/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>3072</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1015,input.161">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="609" name="__module.block.8.layer.1.DenseReluDense.act/aten::relu/Relu" type="ReLU" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</input>
<output>
<port id="1" precision="FP32" names="1016,input.163">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="610" name="self.block.8.layer.1.DenseReluDense.wo.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 3072" offset="344050396" size="9437184" />
<output>
<port id="0" precision="FP32" names="self.block.8.layer.1.DenseReluDense.wo.weight">
<dim>768</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="611" name="__module.block.8.layer.1.DenseReluDense.wo/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>3072</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1019,input.167">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="612" name="__module.block.8.layer.1/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1021,1044,1054,hidden_states.127,hidden_states.129">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="613" name="Constant_12345" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 768" offset="353487580" size="3072" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="614" name="Constant_12344" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629652" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="615" name="Constant_12342" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629656" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="616" name="__module.block.9.layer.0.layer_norm/aten::pow/Power" type="Power" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1045">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="617" name="Constant_3656" type="Const" version="opset1">
<data element_type="i64" shape="1" offset="98629660" size="8" />
<output>
<port id="0" precision="I64" names="1046">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="618" name="__module.block.9.layer.0.layer_norm/aten::mean/ReduceMean" type="ReduceMean" version="opset1">
<data keep_dims="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1047,variance.37">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="619" name="Constant_12343" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629668" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="620" name="__module.block.9.layer.0.layer_norm/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1048">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="621" name="__module.block.9.layer.0.layer_norm/aten::rsqrt/Sqrt" type="Sqrt" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="622" name="__module.block.9.layer.0.layer_norm/aten::rsqrt/Divide" type="Divide" version="opset1">
<data auto_broadcast="numpy" m_pythondiv="true" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1049">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="623" name="__module.block.9.layer.0.layer_norm/aten::mul/Multiply" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1050,hidden_states.131">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="624" name="__module.block.9.layer.0.layer_norm/aten::mul/Multiply_1" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1051,1053,hidden_states.133">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="625" name="self.block.9.layer.0.SelfAttention.q.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="353490652" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.9.layer.0.SelfAttention.q.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="626" name="__module.block.9.layer.0.SelfAttention.q/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1061,query_states.37">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="627" name="Constant_12652" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="628" name="__module.block.9.layer.0.SelfAttention/aten::view/Reshape" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1063">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="629" name="__module.block.9.layer.0.SelfAttention/aten::transpose/Constant" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="630" name="__module.block.9.layer.0.SelfAttention/aten::transpose/Transpose" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1064,query_states.39">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="631" name="self.block.9.layer.0.SelfAttention.k.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="355849948" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.9.layer.0.SelfAttention.k.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="632" name="__module.block.9.layer.0.SelfAttention.k/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1066,key_states.37">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="633" name="Constant_12653" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="634" name="__module.block.9.layer.0.SelfAttention/aten::view/Reshape_1" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1070">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="635" name="__module.block.9.layer.0.SelfAttention/aten::transpose/Constant_1" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="636" name="__module.block.9.layer.0.SelfAttention/aten::transpose/Transpose_1" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1071,key_states.39">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="637" name="__module.block.9.layer.0.SelfAttention/aten::matmul/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1076_1">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="638" name="__module.block.9.layer.0.SelfAttention/aten::add_/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1076,1078,input.169,scores.37">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="639" name="__module.block.9.layer.0.SelfAttention/aten::softmax/Softmax" type="SoftMax" version="opset8">
<data axis="-1" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32" names="1079,1080,input.171">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="640" name="self.block.9.layer.0.SelfAttention.v.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="358209244" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.9.layer.0.SelfAttention.v.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="641" name="__module.block.9.layer.0.SelfAttention.v/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1068,value_states.37">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="642" name="Constant_12654" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="643" name="__module.block.9.layer.0.SelfAttention/aten::view/Reshape_2" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1073">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="644" name="__module.block.9.layer.0.SelfAttention/aten::transpose/Constant_3" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="645" name="__module.block.9.layer.0.SelfAttention/aten::transpose/Transpose_3" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1074,value_states.39">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="646" name="__module.block.9.layer.0.SelfAttention/aten::matmul/MatMul_1" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="false" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1082,attn_output.37">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="647" name="__module.block.9.layer.0.SelfAttention/aten::transpose/Constant_4" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="648" name="__module.block.9.layer.0.SelfAttention/aten::transpose/Transpose_4" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1083">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="649" name="Constant_12655" type="Const" version="opset1">
<data element_type="i64" shape="3" offset="105709252" size="24" />
<output>
<port id="0" precision="I64">
<dim>3</dim>
</port>
</output>
</layer>
<layer id="650" name="__module.block.9.layer.0.SelfAttention/aten::view/Reshape_3" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I64">
<dim>3</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1086,input.173">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="651" name="self.block.9.layer.0.SelfAttention.o.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="360568540" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.9.layer.0.SelfAttention.o.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="652" name="__module.block.9.layer.0.SelfAttention.o/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1088,input.175">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="653" name="__module.block.9.layer.0/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1090,1095,1105,hidden_states.135,hidden_states.137">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="654" name="Constant_12349" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 768" offset="362927836" size="3072" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="655" name="Constant_12348" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629652" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="656" name="Constant_12346" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629656" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="657" name="__module.block.9.layer.1.layer_norm/aten::pow/Power" type="Power" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1096">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="658" name="Constant_3939" type="Const" version="opset1">
<data element_type="i64" shape="1" offset="98629660" size="8" />
<output>
<port id="0" precision="I64" names="1097">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="659" name="__module.block.9.layer.1.layer_norm/aten::mean/ReduceMean" type="ReduceMean" version="opset1">
<data keep_dims="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1098,variance.39">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="660" name="Constant_12347" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629668" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="661" name="__module.block.9.layer.1.layer_norm/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1099">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="662" name="__module.block.9.layer.1.layer_norm/aten::rsqrt/Sqrt" type="Sqrt" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="663" name="__module.block.9.layer.1.layer_norm/aten::rsqrt/Divide" type="Divide" version="opset1">
<data auto_broadcast="numpy" m_pythondiv="true" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1100">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="664" name="__module.block.9.layer.1.layer_norm/aten::mul/Multiply" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1101,hidden_states.139">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="665" name="__module.block.9.layer.1.layer_norm/aten::mul/Multiply_1" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1102,1104,input.177">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="666" name="self.block.9.layer.1.DenseReluDense.wi.weight" type="Const" version="opset1">
<data element_type="f32" shape="3072, 768" offset="362930908" size="9437184" />
<output>
<port id="0" precision="FP32" names="self.block.9.layer.1.DenseReluDense.wi.weight">
<dim>3072</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="667" name="__module.block.9.layer.1.DenseReluDense.wi/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>3072</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1111,input.179">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="668" name="__module.block.9.layer.1.DenseReluDense.act/aten::relu/Relu" type="ReLU" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</input>
<output>
<port id="1" precision="FP32" names="1112,input.181">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="669" name="self.block.9.layer.1.DenseReluDense.wo.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 3072" offset="372368092" size="9437184" />
<output>
<port id="0" precision="FP32" names="self.block.9.layer.1.DenseReluDense.wo.weight">
<dim>768</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="670" name="__module.block.9.layer.1.DenseReluDense.wo/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>3072</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1115,input.185">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="671" name="__module.block.9.layer.1/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1117,1140,1150,hidden_states.141,hidden_states.143">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="672" name="Constant_12353" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 768" offset="381805276" size="3072" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="673" name="Constant_12352" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629652" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="674" name="Constant_12350" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629656" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="675" name="__module.block.10.layer.0.layer_norm/aten::pow/Power" type="Power" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1141">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="676" name="Constant_4018" type="Const" version="opset1">
<data element_type="i64" shape="1" offset="98629660" size="8" />
<output>
<port id="0" precision="I64" names="1142">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="677" name="__module.block.10.layer.0.layer_norm/aten::mean/ReduceMean" type="ReduceMean" version="opset1">
<data keep_dims="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1143,variance.41">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="678" name="Constant_12351" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629668" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="679" name="__module.block.10.layer.0.layer_norm/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1144">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="680" name="__module.block.10.layer.0.layer_norm/aten::rsqrt/Sqrt" type="Sqrt" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="681" name="__module.block.10.layer.0.layer_norm/aten::rsqrt/Divide" type="Divide" version="opset1">
<data auto_broadcast="numpy" m_pythondiv="true" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1145">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="682" name="__module.block.10.layer.0.layer_norm/aten::mul/Multiply" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1146,hidden_states.145">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="683" name="__module.block.10.layer.0.layer_norm/aten::mul/Multiply_1" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1147,1149,hidden_states.147">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="684" name="self.block.10.layer.0.SelfAttention.q.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="381808348" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.10.layer.0.SelfAttention.q.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="685" name="__module.block.10.layer.0.SelfAttention.q/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1157,query_states.41">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="686" name="Constant_12656" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="687" name="__module.block.10.layer.0.SelfAttention/aten::view/Reshape" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1159">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="688" name="__module.block.10.layer.0.SelfAttention/aten::transpose/Constant" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="689" name="__module.block.10.layer.0.SelfAttention/aten::transpose/Transpose" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1160,query_states.43">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="690" name="self.block.10.layer.0.SelfAttention.k.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="384167644" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.10.layer.0.SelfAttention.k.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="691" name="__module.block.10.layer.0.SelfAttention.k/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1162,key_states.41">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="692" name="Constant_12657" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="693" name="__module.block.10.layer.0.SelfAttention/aten::view/Reshape_1" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1166">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="694" name="__module.block.10.layer.0.SelfAttention/aten::transpose/Constant_1" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="695" name="__module.block.10.layer.0.SelfAttention/aten::transpose/Transpose_1" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1167,key_states.43">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="696" name="__module.block.10.layer.0.SelfAttention/aten::matmul/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1172_1">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="697" name="__module.block.10.layer.0.SelfAttention/aten::add_/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1172,1174,input.187,scores.41">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="698" name="__module.block.10.layer.0.SelfAttention/aten::softmax/Softmax" type="SoftMax" version="opset8">
<data axis="-1" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32" names="1175,1176,input.189">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="699" name="self.block.10.layer.0.SelfAttention.v.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="386526940" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.10.layer.0.SelfAttention.v.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="700" name="__module.block.10.layer.0.SelfAttention.v/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1164,value_states.41">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="701" name="Constant_12658" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="702" name="__module.block.10.layer.0.SelfAttention/aten::view/Reshape_2" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1169">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="703" name="__module.block.10.layer.0.SelfAttention/aten::transpose/Constant_3" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="704" name="__module.block.10.layer.0.SelfAttention/aten::transpose/Transpose_3" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1170,value_states.43">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="705" name="__module.block.10.layer.0.SelfAttention/aten::matmul/MatMul_1" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="false" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1178,attn_output.41">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="706" name="__module.block.10.layer.0.SelfAttention/aten::transpose/Constant_4" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="707" name="__module.block.10.layer.0.SelfAttention/aten::transpose/Transpose_4" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1179">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="708" name="Constant_12659" type="Const" version="opset1">
<data element_type="i64" shape="3" offset="105709252" size="24" />
<output>
<port id="0" precision="I64">
<dim>3</dim>
</port>
</output>
</layer>
<layer id="709" name="__module.block.10.layer.0.SelfAttention/aten::view/Reshape_3" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I64">
<dim>3</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1182,input.191">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="710" name="self.block.10.layer.0.SelfAttention.o.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="388886236" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.10.layer.0.SelfAttention.o.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="711" name="__module.block.10.layer.0.SelfAttention.o/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1184,input.193">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="712" name="__module.block.10.layer.0/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1186,1191,1201,hidden_states.149,hidden_states.151">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="713" name="Constant_12357" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 768" offset="391245532" size="3072" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="714" name="Constant_12356" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629652" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="715" name="Constant_12354" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629656" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="716" name="__module.block.10.layer.1.layer_norm/aten::pow/Power" type="Power" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1192">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="717" name="Constant_4301" type="Const" version="opset1">
<data element_type="i64" shape="1" offset="98629660" size="8" />
<output>
<port id="0" precision="I64" names="1193">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="718" name="__module.block.10.layer.1.layer_norm/aten::mean/ReduceMean" type="ReduceMean" version="opset1">
<data keep_dims="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1194,variance.43">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="719" name="Constant_12355" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629668" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="720" name="__module.block.10.layer.1.layer_norm/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1195">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="721" name="__module.block.10.layer.1.layer_norm/aten::rsqrt/Sqrt" type="Sqrt" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="722" name="__module.block.10.layer.1.layer_norm/aten::rsqrt/Divide" type="Divide" version="opset1">
<data auto_broadcast="numpy" m_pythondiv="true" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1196">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="723" name="__module.block.10.layer.1.layer_norm/aten::mul/Multiply" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1197,hidden_states.153">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="724" name="__module.block.10.layer.1.layer_norm/aten::mul/Multiply_1" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1198,1200,input.195">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="725" name="self.block.10.layer.1.DenseReluDense.wi.weight" type="Const" version="opset1">
<data element_type="f32" shape="3072, 768" offset="391248604" size="9437184" />
<output>
<port id="0" precision="FP32" names="self.block.10.layer.1.DenseReluDense.wi.weight">
<dim>3072</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="726" name="__module.block.10.layer.1.DenseReluDense.wi/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>3072</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1207,input.197">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="727" name="__module.block.10.layer.1.DenseReluDense.act/aten::relu/Relu" type="ReLU" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</input>
<output>
<port id="1" precision="FP32" names="1208,input.199">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="728" name="self.block.10.layer.1.DenseReluDense.wo.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 3072" offset="400685788" size="9437184" />
<output>
<port id="0" precision="FP32" names="self.block.10.layer.1.DenseReluDense.wo.weight">
<dim>768</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="729" name="__module.block.10.layer.1.DenseReluDense.wo/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>3072</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1211,input.203">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="730" name="__module.block.10.layer.1/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1213,1236,1246,hidden_states.155,hidden_states.157">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="731" name="Constant_12361" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 768" offset="410122972" size="3072" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="732" name="Constant_12360" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629652" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="733" name="Constant_12358" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629656" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="734" name="__module.block.11.layer.0.layer_norm/aten::pow/Power" type="Power" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1237">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="735" name="Constant_4380" type="Const" version="opset1">
<data element_type="i64" shape="1" offset="98629660" size="8" />
<output>
<port id="0" precision="I64" names="1238">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="736" name="__module.block.11.layer.0.layer_norm/aten::mean/ReduceMean" type="ReduceMean" version="opset1">
<data keep_dims="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1239,variance.45">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="737" name="Constant_12359" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629668" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="738" name="__module.block.11.layer.0.layer_norm/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1240">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="739" name="__module.block.11.layer.0.layer_norm/aten::rsqrt/Sqrt" type="Sqrt" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="740" name="__module.block.11.layer.0.layer_norm/aten::rsqrt/Divide" type="Divide" version="opset1">
<data auto_broadcast="numpy" m_pythondiv="true" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1241">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="741" name="__module.block.11.layer.0.layer_norm/aten::mul/Multiply" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1242,hidden_states.159">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="742" name="__module.block.11.layer.0.layer_norm/aten::mul/Multiply_1" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1243,1245,hidden_states.161">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="743" name="self.block.11.layer.0.SelfAttention.q.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="410126044" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.11.layer.0.SelfAttention.q.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="744" name="__module.block.11.layer.0.SelfAttention.q/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1253,query_states.45">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="745" name="Constant_12660" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="746" name="__module.block.11.layer.0.SelfAttention/aten::view/Reshape" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1255">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="747" name="__module.block.11.layer.0.SelfAttention/aten::transpose/Constant" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="748" name="__module.block.11.layer.0.SelfAttention/aten::transpose/Transpose" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1256,query_states">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="749" name="self.block.11.layer.0.SelfAttention.k.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="412485340" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.11.layer.0.SelfAttention.k.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="750" name="__module.block.11.layer.0.SelfAttention.k/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1258,key_states.45">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="751" name="Constant_12661" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="752" name="__module.block.11.layer.0.SelfAttention/aten::view/Reshape_1" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1262">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="753" name="__module.block.11.layer.0.SelfAttention/aten::transpose/Constant_1" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="754" name="__module.block.11.layer.0.SelfAttention/aten::transpose/Transpose_1" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1263,key_states">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="755" name="__module.block.11.layer.0.SelfAttention/aten::matmul/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1268_1">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="756" name="__module.block.11.layer.0.SelfAttention/aten::add_/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1268,1270,input.205,scores.45">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="757" name="__module.block.11.layer.0.SelfAttention/aten::softmax/Softmax" type="SoftMax" version="opset8">
<data axis="-1" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32" names="1271,1272,input.207">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
</output>
</layer>
<layer id="758" name="self.block.11.layer.0.SelfAttention.v.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="414844636" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.11.layer.0.SelfAttention.v.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="759" name="__module.block.11.layer.0.SelfAttention.v/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1260,value_states.45">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="760" name="Constant_12662" type="Const" version="opset1">
<data element_type="i64" shape="4" offset="100988968" size="32" />
<output>
<port id="0" precision="I64">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="761" name="__module.block.11.layer.0.SelfAttention/aten::view/Reshape_2" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1265">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="762" name="__module.block.11.layer.0.SelfAttention/aten::transpose/Constant_3" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="763" name="__module.block.11.layer.0.SelfAttention/aten::transpose/Transpose_3" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1266,value_states">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="764" name="__module.block.11.layer.0.SelfAttention/aten::matmul/MatMul_1" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="false" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>-1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1274,attn_output.45">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="765" name="__module.block.11.layer.0.SelfAttention/aten::transpose/Constant_4" type="Const" version="opset1">
<data element_type="i32" shape="4" offset="100989000" size="16" />
<output>
<port id="0" precision="I32">
<dim>4</dim>
</port>
</output>
</layer>
<layer id="766" name="__module.block.11.layer.0.SelfAttention/aten::transpose/Transpose_4" type="Transpose" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>12</dim>
<dim>-1</dim>
<dim>64</dim>
</port>
<port id="1" precision="I32">
<dim>4</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1275">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
</output>
</layer>
<layer id="767" name="Constant_12663" type="Const" version="opset1">
<data element_type="i64" shape="3" offset="105709252" size="24" />
<output>
<port id="0" precision="I64">
<dim>3</dim>
</port>
</output>
</layer>
<layer id="768" name="__module.block.11.layer.0.SelfAttention/aten::view/Reshape_3" type="Reshape" version="opset1">
<data special_zero="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>12</dim>
<dim>64</dim>
</port>
<port id="1" precision="I64">
<dim>3</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1278,input.209">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="769" name="self.block.11.layer.0.SelfAttention.o.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 768" offset="417203932" size="2359296" />
<output>
<port id="0" precision="FP32" names="self.block.11.layer.0.SelfAttention.o.weight">
<dim>768</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="770" name="__module.block.11.layer.0.SelfAttention.o/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1280,input.211">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="771" name="__module.block.11.layer.0/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1282,1287,1297,hidden_states.163,hidden_states.165">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="772" name="Constant_12365" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 768" offset="419563228" size="3072" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="773" name="Constant_12364" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629652" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="774" name="Constant_12362" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629656" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="775" name="__module.block.11.layer.1.layer_norm/aten::pow/Power" type="Power" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1288">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="776" name="Constant_4663" type="Const" version="opset1">
<data element_type="i64" shape="1" offset="98629660" size="8" />
<output>
<port id="0" precision="I64" names="1289">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="777" name="__module.block.11.layer.1.layer_norm/aten::mean/ReduceMean" type="ReduceMean" version="opset1">
<data keep_dims="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1290,variance.47">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="778" name="Constant_12363" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629668" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="779" name="__module.block.11.layer.1.layer_norm/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1291">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="780" name="__module.block.11.layer.1.layer_norm/aten::rsqrt/Sqrt" type="Sqrt" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="781" name="__module.block.11.layer.1.layer_norm/aten::rsqrt/Divide" type="Divide" version="opset1">
<data auto_broadcast="numpy" m_pythondiv="true" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1292">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="782" name="__module.block.11.layer.1.layer_norm/aten::mul/Multiply" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1293,hidden_states.167">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="783" name="__module.block.11.layer.1.layer_norm/aten::mul/Multiply_1" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1294,1296,input.213">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="784" name="self.block.11.layer.1.DenseReluDense.wi.weight" type="Const" version="opset1">
<data element_type="f32" shape="3072, 768" offset="419566300" size="9437184" />
<output>
<port id="0" precision="FP32" names="self.block.11.layer.1.DenseReluDense.wi.weight">
<dim>3072</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="785" name="__module.block.11.layer.1.DenseReluDense.wi/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>3072</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1303,input.215">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="786" name="__module.block.11.layer.1.DenseReluDense.act/aten::relu/Relu" type="ReLU" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</input>
<output>
<port id="1" precision="FP32" names="1304,input.217">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="787" name="self.block.11.layer.1.DenseReluDense.wo.weight" type="Const" version="opset1">
<data element_type="f32" shape="768, 3072" offset="429003484" size="9437184" />
<output>
<port id="0" precision="FP32" names="self.block.11.layer.1.DenseReluDense.wo.weight">
<dim>768</dim>
<dim>3072</dim>
</port>
</output>
</layer>
<layer id="788" name="__module.block.11.layer.1.DenseReluDense.wo/aten::linear/MatMul" type="MatMul" version="opset1">
<data transpose_a="false" transpose_b="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>3072</dim>
</port>
<port id="1" precision="FP32">
<dim>768</dim>
<dim>3072</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1307,input.221">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="789" name="__module.block.11.layer.1/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1309,1319,hidden_states.169,hidden_states.171">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="790" name="Constant_12368" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629652" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="791" name="Constant_12366" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629656" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="792" name="__module.final_layer_norm/aten::pow/Power" type="Power" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1320">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="793" name="Constant_4729" type="Const" version="opset1">
<data element_type="i64" shape="1" offset="98629660" size="8" />
<output>
<port id="0" precision="I64" names="1321">
<dim>1</dim>
</port>
</output>
</layer>
<layer id="794" name="__module.final_layer_norm/aten::mean/ReduceMean" type="ReduceMean" version="opset1">
<data keep_dims="true" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="I64">
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1322,variance">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="795" name="Constant_12367" type="Const" version="opset1">
<data element_type="f32" shape="1, 1, 1" offset="98629668" size="4" />
<output>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="796" name="__module.final_layer_norm/aten::add/Add" type="Add" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1323">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="797" name="__module.final_layer_norm/aten::rsqrt/Sqrt" type="Sqrt" version="opset1">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="798" name="__module.final_layer_norm/aten::rsqrt/Divide" type="Divide" version="opset1">
<data auto_broadcast="numpy" m_pythondiv="true" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>1</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1324">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</output>
</layer>
<layer id="799" name="__module.final_layer_norm/aten::mul/Multiply" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>1</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="1325,hidden_states">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="800" name="__module.final_layer_norm/aten::mul/Multiply_1" type="Multiply" version="opset1">
<data auto_broadcast="numpy" />
<input>
<port id="0" precision="FP32">
<dim>1</dim>
<dim>1</dim>
<dim>768</dim>
</port>
<port id="1" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
<output>
<port id="2" precision="FP32" names="last_hidden_state">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</output>
</layer>
<layer id="801" name="Result_4892" type="Result" version="opset1" output_names="last_hidden_state">
<input>
<port id="0" precision="FP32">
<dim>-1</dim>
<dim>-1</dim>
<dim>768</dim>
</port>
</input>
</layer>
</layers>
<edges>
<edge from-layer="0" from-port="0" to-layer="93" to-port="0" />
<edge from-layer="1" from-port="0" to-layer="5" to-port="0" />
<edge from-layer="1" from-port="0" to-layer="36" to-port="0" />
<edge from-layer="2" from-port="0" to-layer="800" to-port="0" />
<edge from-layer="3" from-port="0" to-layer="8" to-port="0" />
<edge from-layer="4" from-port="0" to-layer="5" to-port="1" />
<edge from-layer="5" from-port="2" to-layer="6" to-port="0" />
<edge from-layer="6" from-port="1" to-layer="8" to-port="1" />
<edge from-layer="7" from-port="0" to-layer="8" to-port="2" />
<edge from-layer="8" from-port="3" to-layer="122" to-port="0" />
<edge from-layer="8" from-port="3" to-layer="19" to-port="0" />
<edge from-layer="8" from-port="3" to-layer="12" to-port="0" />
<edge from-layer="9" from-port="0" to-layer="20" to-port="0" />
<edge from-layer="10" from-port="0" to-layer="18" to-port="0" />
<edge from-layer="11" from-port="0" to-layer="12" to-port="1" />
<edge from-layer="12" from-port="2" to-layer="14" to-port="0" />
<edge from-layer="13" from-port="0" to-layer="14" to-port="1" />
<edge from-layer="14" from-port="2" to-layer="16" to-port="0" />
<edge from-layer="15" from-port="0" to-layer="16" to-port="1" />
<edge from-layer="16" from-port="2" to-layer="17" to-port="0" />
<edge from-layer="17" from-port="1" to-layer="18" to-port="1" />
<edge from-layer="18" from-port="2" to-layer="19" to-port="1" />
<edge from-layer="19" from-port="2" to-layer="20" to-port="1" />
<edge from-layer="20" from-port="2" to-layer="110" to-port="0" />
<edge from-layer="20" from-port="2" to-layer="28" to-port="0" />
<edge from-layer="20" from-port="2" to-layer="22" to-port="0" />
<edge from-layer="21" from-port="0" to-layer="22" to-port="1" />
<edge from-layer="22" from-port="2" to-layer="24" to-port="0" />
<edge from-layer="23" from-port="0" to-layer="24" to-port="1" />
<edge from-layer="24" from-port="2" to-layer="26" to-port="0" />
<edge from-layer="25" from-port="0" to-layer="26" to-port="1" />
<edge from-layer="26" from-port="2" to-layer="33" to-port="0" />
<edge from-layer="27" from-port="0" to-layer="28" to-port="1" />
<edge from-layer="28" from-port="2" to-layer="30" to-port="0" />
<edge from-layer="29" from-port="0" to-layer="30" to-port="1" />
<edge from-layer="30" from-port="2" to-layer="32" to-port="0" />
<edge from-layer="31" from-port="0" to-layer="32" to-port="1" />
<edge from-layer="32" from-port="2" to-layer="33" to-port="1" />
<edge from-layer="33" from-port="2" to-layer="107" to-port="0" />
<edge from-layer="34" from-port="0" to-layer="76" to-port="0" />
<edge from-layer="35" from-port="0" to-layer="41" to-port="0" />
<edge from-layer="36" from-port="1" to-layer="39" to-port="0" />
<edge from-layer="37" from-port="0" to-layer="39" to-port="1" />
<edge from-layer="38" from-port="0" to-layer="39" to-port="2" />
<edge from-layer="39" from-port="3" to-layer="46" to-port="1" />
<edge from-layer="39" from-port="3" to-layer="81" to-port="0" />
<edge from-layer="39" from-port="3" to-layer="41" to-port="1" />
<edge from-layer="40" from-port="0" to-layer="41" to-port="2" />
<edge from-layer="41" from-port="3" to-layer="43" to-port="0" />
<edge from-layer="42" from-port="0" to-layer="79" to-port="1" />
<edge from-layer="42" from-port="0" to-layer="43" to-port="1" />
<edge from-layer="43" from-port="2" to-layer="50" to-port="0" />
<edge from-layer="44" from-port="0" to-layer="46" to-port="0" />
<edge from-layer="45" from-port="0" to-layer="46" to-port="2" />
<edge from-layer="46" from-port="3" to-layer="48" to-port="0" />
<edge from-layer="47" from-port="0" to-layer="48" to-port="1" />
<edge from-layer="48" from-port="2" to-layer="49" to-port="0" />
<edge from-layer="49" from-port="1" to-layer="50" to-port="1" />
<edge from-layer="50" from-port="2" to-layer="56" to-port="0" />
<edge from-layer="50" from-port="2" to-layer="52" to-port="0" />
<edge from-layer="51" from-port="0" to-layer="52" to-port="1" />
<edge from-layer="52" from-port="2" to-layer="53" to-port="0" />
<edge from-layer="53" from-port="1" to-layer="55" to-port="0" />
<edge from-layer="54" from-port="0" to-layer="55" to-port="1" />
<edge from-layer="55" from-port="2" to-layer="73" to-port="0" />
<edge from-layer="56" from-port="1" to-layer="59" to-port="0" />
<edge from-layer="56" from-port="1" to-layer="58" to-port="0" />
<edge from-layer="56" from-port="1" to-layer="72" to-port="1" />
<edge from-layer="57" from-port="0" to-layer="58" to-port="1" />
<edge from-layer="58" from-port="2" to-layer="72" to-port="0" />
<edge from-layer="59" from-port="1" to-layer="61" to-port="0" />
<edge from-layer="60" from-port="0" to-layer="61" to-port="1" />
<edge from-layer="61" from-port="2" to-layer="62" to-port="0" />
<edge from-layer="62" from-port="1" to-layer="64" to-port="0" />
<edge from-layer="63" from-port="0" to-layer="64" to-port="1" />
<edge from-layer="64" from-port="2" to-layer="66" to-port="0" />
<edge from-layer="65" from-port="0" to-layer="66" to-port="1" />
<edge from-layer="66" from-port="2" to-layer="67" to-port="0" />
<edge from-layer="67" from-port="1" to-layer="69" to-port="0" />
<edge from-layer="68" from-port="0" to-layer="69" to-port="1" />
<edge from-layer="69" from-port="2" to-layer="71" to-port="0" />
<edge from-layer="70" from-port="0" to-layer="71" to-port="1" />
<edge from-layer="71" from-port="2" to-layer="72" to-port="2" />
<edge from-layer="72" from-port="3" to-layer="73" to-port="1" />
<edge from-layer="73" from-port="2" to-layer="74" to-port="0" />
<edge from-layer="74" from-port="1" to-layer="76" to-port="1" />
<edge from-layer="75" from-port="0" to-layer="76" to-port="2" />
<edge from-layer="76" from-port="3" to-layer="78" to-port="0" />
<edge from-layer="77" from-port="0" to-layer="78" to-port="1" />
<edge from-layer="78" from-port="2" to-layer="79" to-port="0" />
<edge from-layer="79" from-port="2" to-layer="90" to-port="0" />
<edge from-layer="80" from-port="0" to-layer="81" to-port="1" />
<edge from-layer="81" from-port="2" to-layer="86" to-port="0" />
<edge from-layer="81" from-port="2" to-layer="105" to-port="2" />
<edge from-layer="82" from-port="0" to-layer="83" to-port="0" />
<edge from-layer="83" from-port="1" to-layer="85" to-port="0" />
<edge from-layer="84" from-port="0" to-layer="85" to-port="1" />
<edge from-layer="85" from-port="2" to-layer="86" to-port="1" />
<edge from-layer="86" from-port="2" to-layer="90" to-port="1" />
<edge from-layer="87" from-port="0" to-layer="90" to-port="2" />
<edge from-layer="88" from-port="0" to-layer="90" to-port="3" />
<edge from-layer="89" from-port="0" to-layer="90" to-port="4" />
<edge from-layer="90" from-port="5" to-layer="106" to-port="0" />
<edge from-layer="91" from-port="0" to-layer="99" to-port="0" />
<edge from-layer="92" from-port="0" to-layer="93" to-port="1" />
<edge from-layer="93" from-port="2" to-layer="95" to-port="0" />
<edge from-layer="94" from-port="0" to-layer="95" to-port="1" />
<edge from-layer="95" from-port="2" to-layer="96" to-port="0" />
<edge from-layer="96" from-port="1" to-layer="98" to-port="0" />
<edge from-layer="97" from-port="0" to-layer="98" to-port="1" />
<edge from-layer="98" from-port="2" to-layer="99" to-port="1" />
<edge from-layer="99" from-port="2" to-layer="101" to-port="0" />
<edge from-layer="100" from-port="0" to-layer="101" to-port="1" />
<edge from-layer="101" from-port="2" to-layer="105" to-port="0" />
<edge from-layer="102" from-port="0" to-layer="105" to-port="1" />
<edge from-layer="103" from-port="0" to-layer="105" to-port="3" />
<edge from-layer="104" from-port="0" to-layer="105" to-port="4" />
<edge from-layer="105" from-port="5" to-layer="106" to-port="1" />
<edge from-layer="106" from-port="2" to-layer="402" to-port="1" />
<edge from-layer="106" from-port="2" to-layer="343" to-port="1" />
<edge from-layer="106" from-port="2" to-layer="284" to-port="1" />
<edge from-layer="106" from-port="2" to-layer="756" to-port="1" />
<edge from-layer="106" from-port="2" to-layer="697" to-port="1" />
<edge from-layer="106" from-port="2" to-layer="638" to-port="1" />
<edge from-layer="106" from-port="2" to-layer="579" to-port="1" />
<edge from-layer="106" from-port="2" to-layer="520" to-port="1" />
<edge from-layer="106" from-port="2" to-layer="461" to-port="1" />
<edge from-layer="106" from-port="2" to-layer="166" to-port="1" />
<edge from-layer="106" from-port="2" to-layer="225" to-port="1" />
<edge from-layer="106" from-port="2" to-layer="107" to-port="1" />
<edge from-layer="107" from-port="2" to-layer="108" to-port="0" />
<edge from-layer="108" from-port="1" to-layer="115" to-port="0" />
<edge from-layer="109" from-port="0" to-layer="110" to-port="1" />
<edge from-layer="110" from-port="2" to-layer="112" to-port="0" />
<edge from-layer="111" from-port="0" to-layer="112" to-port="1" />
<edge from-layer="112" from-port="2" to-layer="114" to-port="0" />
<edge from-layer="113" from-port="0" to-layer="114" to-port="1" />
<edge from-layer="114" from-port="2" to-layer="115" to-port="1" />
<edge from-layer="115" from-port="2" to-layer="117" to-port="0" />
<edge from-layer="116" from-port="0" to-layer="117" to-port="1" />
<edge from-layer="117" from-port="2" to-layer="119" to-port="0" />
<edge from-layer="118" from-port="0" to-layer="119" to-port="1" />
<edge from-layer="119" from-port="2" to-layer="121" to-port="0" />
<edge from-layer="120" from-port="0" to-layer="121" to-port="1" />
<edge from-layer="121" from-port="2" to-layer="122" to-port="1" />
<edge from-layer="122" from-port="2" to-layer="126" to-port="0" />
<edge from-layer="122" from-port="2" to-layer="140" to-port="0" />
<edge from-layer="122" from-port="2" to-layer="133" to-port="0" />
<edge from-layer="123" from-port="0" to-layer="134" to-port="0" />
<edge from-layer="124" from-port="0" to-layer="132" to-port="0" />
<edge from-layer="125" from-port="0" to-layer="126" to-port="1" />
<edge from-layer="126" from-port="2" to-layer="128" to-port="0" />
<edge from-layer="127" from-port="0" to-layer="128" to-port="1" />
<edge from-layer="128" from-port="2" to-layer="130" to-port="0" />
<edge from-layer="129" from-port="0" to-layer="130" to-port="1" />
<edge from-layer="130" from-port="2" to-layer="131" to-port="0" />
<edge from-layer="131" from-port="1" to-layer="132" to-port="1" />
<edge from-layer="132" from-port="2" to-layer="133" to-port="1" />
<edge from-layer="133" from-port="2" to-layer="134" to-port="1" />
<edge from-layer="134" from-port="2" to-layer="136" to-port="0" />
<edge from-layer="135" from-port="0" to-layer="136" to-port="1" />
<edge from-layer="136" from-port="2" to-layer="137" to-port="0" />
<edge from-layer="137" from-port="1" to-layer="139" to-port="0" />
<edge from-layer="138" from-port="0" to-layer="139" to-port="1" />
<edge from-layer="139" from-port="2" to-layer="140" to-port="1" />
<edge from-layer="140" from-port="2" to-layer="181" to-port="0" />
<edge from-layer="140" from-port="2" to-layer="144" to-port="0" />
<edge from-layer="140" from-port="2" to-layer="151" to-port="0" />
<edge from-layer="141" from-port="0" to-layer="152" to-port="0" />
<edge from-layer="142" from-port="0" to-layer="150" to-port="0" />
<edge from-layer="143" from-port="0" to-layer="144" to-port="1" />
<edge from-layer="144" from-port="2" to-layer="146" to-port="0" />
<edge from-layer="145" from-port="0" to-layer="146" to-port="1" />
<edge from-layer="146" from-port="2" to-layer="148" to-port="0" />
<edge from-layer="147" from-port="0" to-layer="148" to-port="1" />
<edge from-layer="148" from-port="2" to-layer="149" to-port="0" />
<edge from-layer="149" from-port="1" to-layer="150" to-port="1" />
<edge from-layer="150" from-port="2" to-layer="151" to-port="1" />
<edge from-layer="151" from-port="2" to-layer="152" to-port="1" />
<edge from-layer="152" from-port="2" to-layer="160" to-port="0" />
<edge from-layer="152" from-port="2" to-layer="169" to-port="0" />
<edge from-layer="152" from-port="2" to-layer="154" to-port="0" />
<edge from-layer="153" from-port="0" to-layer="154" to-port="1" />
<edge from-layer="154" from-port="2" to-layer="156" to-port="0" />
<edge from-layer="155" from-port="0" to-layer="156" to-port="1" />
<edge from-layer="156" from-port="2" to-layer="158" to-port="0" />
<edge from-layer="157" from-port="0" to-layer="158" to-port="1" />
<edge from-layer="158" from-port="2" to-layer="165" to-port="0" />
<edge from-layer="159" from-port="0" to-layer="160" to-port="1" />
<edge from-layer="160" from-port="2" to-layer="162" to-port="0" />
<edge from-layer="161" from-port="0" to-layer="162" to-port="1" />
<edge from-layer="162" from-port="2" to-layer="164" to-port="0" />
<edge from-layer="163" from-port="0" to-layer="164" to-port="1" />
<edge from-layer="164" from-port="2" to-layer="165" to-port="1" />
<edge from-layer="165" from-port="2" to-layer="166" to-port="0" />
<edge from-layer="166" from-port="2" to-layer="167" to-port="0" />
<edge from-layer="167" from-port="1" to-layer="174" to-port="0" />
<edge from-layer="168" from-port="0" to-layer="169" to-port="1" />
<edge from-layer="169" from-port="2" to-layer="171" to-port="0" />
<edge from-layer="170" from-port="0" to-layer="171" to-port="1" />
<edge from-layer="171" from-port="2" to-layer="173" to-port="0" />
<edge from-layer="172" from-port="0" to-layer="173" to-port="1" />
<edge from-layer="173" from-port="2" to-layer="174" to-port="1" />
<edge from-layer="174" from-port="2" to-layer="176" to-port="0" />
<edge from-layer="175" from-port="0" to-layer="176" to-port="1" />
<edge from-layer="176" from-port="2" to-layer="178" to-port="0" />
<edge from-layer="177" from-port="0" to-layer="178" to-port="1" />
<edge from-layer="178" from-port="2" to-layer="180" to-port="0" />
<edge from-layer="179" from-port="0" to-layer="180" to-port="1" />
<edge from-layer="180" from-port="2" to-layer="181" to-port="1" />
<edge from-layer="181" from-port="2" to-layer="185" to-port="0" />
<edge from-layer="181" from-port="2" to-layer="199" to-port="0" />
<edge from-layer="181" from-port="2" to-layer="192" to-port="0" />
<edge from-layer="182" from-port="0" to-layer="193" to-port="0" />
<edge from-layer="183" from-port="0" to-layer="191" to-port="0" />
<edge from-layer="184" from-port="0" to-layer="185" to-port="1" />
<edge from-layer="185" from-port="2" to-layer="187" to-port="0" />
<edge from-layer="186" from-port="0" to-layer="187" to-port="1" />
<edge from-layer="187" from-port="2" to-layer="189" to-port="0" />
<edge from-layer="188" from-port="0" to-layer="189" to-port="1" />
<edge from-layer="189" from-port="2" to-layer="190" to-port="0" />
<edge from-layer="190" from-port="1" to-layer="191" to-port="1" />
<edge from-layer="191" from-port="2" to-layer="192" to-port="1" />
<edge from-layer="192" from-port="2" to-layer="193" to-port="1" />
<edge from-layer="193" from-port="2" to-layer="195" to-port="0" />
<edge from-layer="194" from-port="0" to-layer="195" to-port="1" />
<edge from-layer="195" from-port="2" to-layer="196" to-port="0" />
<edge from-layer="196" from-port="1" to-layer="198" to-port="0" />
<edge from-layer="197" from-port="0" to-layer="198" to-port="1" />
<edge from-layer="198" from-port="2" to-layer="199" to-port="1" />
<edge from-layer="199" from-port="2" to-layer="240" to-port="0" />
<edge from-layer="199" from-port="2" to-layer="210" to-port="0" />
<edge from-layer="199" from-port="2" to-layer="203" to-port="0" />
<edge from-layer="200" from-port="0" to-layer="211" to-port="0" />
<edge from-layer="201" from-port="0" to-layer="209" to-port="0" />
<edge from-layer="202" from-port="0" to-layer="203" to-port="1" />
<edge from-layer="203" from-port="2" to-layer="205" to-port="0" />
<edge from-layer="204" from-port="0" to-layer="205" to-port="1" />
<edge from-layer="205" from-port="2" to-layer="207" to-port="0" />
<edge from-layer="206" from-port="0" to-layer="207" to-port="1" />
<edge from-layer="207" from-port="2" to-layer="208" to-port="0" />
<edge from-layer="208" from-port="1" to-layer="209" to-port="1" />
<edge from-layer="209" from-port="2" to-layer="210" to-port="1" />
<edge from-layer="210" from-port="2" to-layer="211" to-port="1" />
<edge from-layer="211" from-port="2" to-layer="219" to-port="0" />
<edge from-layer="211" from-port="2" to-layer="213" to-port="0" />
<edge from-layer="211" from-port="2" to-layer="228" to-port="0" />
<edge from-layer="212" from-port="0" to-layer="213" to-port="1" />
<edge from-layer="213" from-port="2" to-layer="215" to-port="0" />
<edge from-layer="214" from-port="0" to-layer="215" to-port="1" />
<edge from-layer="215" from-port="2" to-layer="217" to-port="0" />
<edge from-layer="216" from-port="0" to-layer="217" to-port="1" />
<edge from-layer="217" from-port="2" to-layer="224" to-port="0" />
<edge from-layer="218" from-port="0" to-layer="219" to-port="1" />
<edge from-layer="219" from-port="2" to-layer="221" to-port="0" />
<edge from-layer="220" from-port="0" to-layer="221" to-port="1" />
<edge from-layer="221" from-port="2" to-layer="223" to-port="0" />
<edge from-layer="222" from-port="0" to-layer="223" to-port="1" />
<edge from-layer="223" from-port="2" to-layer="224" to-port="1" />
<edge from-layer="224" from-port="2" to-layer="225" to-port="0" />
<edge from-layer="225" from-port="2" to-layer="226" to-port="0" />
<edge from-layer="226" from-port="1" to-layer="233" to-port="0" />
<edge from-layer="227" from-port="0" to-layer="228" to-port="1" />
<edge from-layer="228" from-port="2" to-layer="230" to-port="0" />
<edge from-layer="229" from-port="0" to-layer="230" to-port="1" />
<edge from-layer="230" from-port="2" to-layer="232" to-port="0" />
<edge from-layer="231" from-port="0" to-layer="232" to-port="1" />
<edge from-layer="232" from-port="2" to-layer="233" to-port="1" />
<edge from-layer="233" from-port="2" to-layer="235" to-port="0" />
<edge from-layer="234" from-port="0" to-layer="235" to-port="1" />
<edge from-layer="235" from-port="2" to-layer="237" to-port="0" />
<edge from-layer="236" from-port="0" to-layer="237" to-port="1" />
<edge from-layer="237" from-port="2" to-layer="239" to-port="0" />
<edge from-layer="238" from-port="0" to-layer="239" to-port="1" />
<edge from-layer="239" from-port="2" to-layer="240" to-port="1" />
<edge from-layer="240" from-port="2" to-layer="251" to-port="0" />
<edge from-layer="240" from-port="2" to-layer="258" to-port="0" />
<edge from-layer="240" from-port="2" to-layer="244" to-port="0" />
<edge from-layer="241" from-port="0" to-layer="252" to-port="0" />
<edge from-layer="242" from-port="0" to-layer="250" to-port="0" />
<edge from-layer="243" from-port="0" to-layer="244" to-port="1" />
<edge from-layer="244" from-port="2" to-layer="246" to-port="0" />
<edge from-layer="245" from-port="0" to-layer="246" to-port="1" />
<edge from-layer="246" from-port="2" to-layer="248" to-port="0" />
<edge from-layer="247" from-port="0" to-layer="248" to-port="1" />
<edge from-layer="248" from-port="2" to-layer="249" to-port="0" />
<edge from-layer="249" from-port="1" to-layer="250" to-port="1" />
<edge from-layer="250" from-port="2" to-layer="251" to-port="1" />
<edge from-layer="251" from-port="2" to-layer="252" to-port="1" />
<edge from-layer="252" from-port="2" to-layer="254" to-port="0" />
<edge from-layer="253" from-port="0" to-layer="254" to-port="1" />
<edge from-layer="254" from-port="2" to-layer="255" to-port="0" />
<edge from-layer="255" from-port="1" to-layer="257" to-port="0" />
<edge from-layer="256" from-port="0" to-layer="257" to-port="1" />
<edge from-layer="257" from-port="2" to-layer="258" to-port="1" />
<edge from-layer="258" from-port="2" to-layer="269" to-port="0" />
<edge from-layer="258" from-port="2" to-layer="262" to-port="0" />
<edge from-layer="258" from-port="2" to-layer="299" to-port="0" />
<edge from-layer="259" from-port="0" to-layer="270" to-port="0" />
<edge from-layer="260" from-port="0" to-layer="268" to-port="0" />
<edge from-layer="261" from-port="0" to-layer="262" to-port="1" />
<edge from-layer="262" from-port="2" to-layer="264" to-port="0" />
<edge from-layer="263" from-port="0" to-layer="264" to-port="1" />
<edge from-layer="264" from-port="2" to-layer="266" to-port="0" />
<edge from-layer="265" from-port="0" to-layer="266" to-port="1" />
<edge from-layer="266" from-port="2" to-layer="267" to-port="0" />
<edge from-layer="267" from-port="1" to-layer="268" to-port="1" />
<edge from-layer="268" from-port="2" to-layer="269" to-port="1" />
<edge from-layer="269" from-port="2" to-layer="270" to-port="1" />
<edge from-layer="270" from-port="2" to-layer="287" to-port="0" />
<edge from-layer="270" from-port="2" to-layer="278" to-port="0" />
<edge from-layer="270" from-port="2" to-layer="272" to-port="0" />
<edge from-layer="271" from-port="0" to-layer="272" to-port="1" />
<edge from-layer="272" from-port="2" to-layer="274" to-port="0" />
<edge from-layer="273" from-port="0" to-layer="274" to-port="1" />
<edge from-layer="274" from-port="2" to-layer="276" to-port="0" />
<edge from-layer="275" from-port="0" to-layer="276" to-port="1" />
<edge from-layer="276" from-port="2" to-layer="283" to-port="0" />
<edge from-layer="277" from-port="0" to-layer="278" to-port="1" />
<edge from-layer="278" from-port="2" to-layer="280" to-port="0" />
<edge from-layer="279" from-port="0" to-layer="280" to-port="1" />
<edge from-layer="280" from-port="2" to-layer="282" to-port="0" />
<edge from-layer="281" from-port="0" to-layer="282" to-port="1" />
<edge from-layer="282" from-port="2" to-layer="283" to-port="1" />
<edge from-layer="283" from-port="2" to-layer="284" to-port="0" />
<edge from-layer="284" from-port="2" to-layer="285" to-port="0" />
<edge from-layer="285" from-port="1" to-layer="292" to-port="0" />
<edge from-layer="286" from-port="0" to-layer="287" to-port="1" />
<edge from-layer="287" from-port="2" to-layer="289" to-port="0" />
<edge from-layer="288" from-port="0" to-layer="289" to-port="1" />
<edge from-layer="289" from-port="2" to-layer="291" to-port="0" />
<edge from-layer="290" from-port="0" to-layer="291" to-port="1" />
<edge from-layer="291" from-port="2" to-layer="292" to-port="1" />
<edge from-layer="292" from-port="2" to-layer="294" to-port="0" />
<edge from-layer="293" from-port="0" to-layer="294" to-port="1" />
<edge from-layer="294" from-port="2" to-layer="296" to-port="0" />
<edge from-layer="295" from-port="0" to-layer="296" to-port="1" />
<edge from-layer="296" from-port="2" to-layer="298" to-port="0" />
<edge from-layer="297" from-port="0" to-layer="298" to-port="1" />
<edge from-layer="298" from-port="2" to-layer="299" to-port="1" />
<edge from-layer="299" from-port="2" to-layer="303" to-port="0" />
<edge from-layer="299" from-port="2" to-layer="310" to-port="0" />
<edge from-layer="299" from-port="2" to-layer="317" to-port="0" />
<edge from-layer="300" from-port="0" to-layer="311" to-port="0" />
<edge from-layer="301" from-port="0" to-layer="309" to-port="0" />
<edge from-layer="302" from-port="0" to-layer="303" to-port="1" />
<edge from-layer="303" from-port="2" to-layer="305" to-port="0" />
<edge from-layer="304" from-port="0" to-layer="305" to-port="1" />
<edge from-layer="305" from-port="2" to-layer="307" to-port="0" />
<edge from-layer="306" from-port="0" to-layer="307" to-port="1" />
<edge from-layer="307" from-port="2" to-layer="308" to-port="0" />
<edge from-layer="308" from-port="1" to-layer="309" to-port="1" />
<edge from-layer="309" from-port="2" to-layer="310" to-port="1" />
<edge from-layer="310" from-port="2" to-layer="311" to-port="1" />
<edge from-layer="311" from-port="2" to-layer="313" to-port="0" />
<edge from-layer="312" from-port="0" to-layer="313" to-port="1" />
<edge from-layer="313" from-port="2" to-layer="314" to-port="0" />
<edge from-layer="314" from-port="1" to-layer="316" to-port="0" />
<edge from-layer="315" from-port="0" to-layer="316" to-port="1" />
<edge from-layer="316" from-port="2" to-layer="317" to-port="1" />
<edge from-layer="317" from-port="2" to-layer="328" to-port="0" />
<edge from-layer="317" from-port="2" to-layer="321" to-port="0" />
<edge from-layer="317" from-port="2" to-layer="358" to-port="0" />
<edge from-layer="318" from-port="0" to-layer="329" to-port="0" />
<edge from-layer="319" from-port="0" to-layer="327" to-port="0" />
<edge from-layer="320" from-port="0" to-layer="321" to-port="1" />
<edge from-layer="321" from-port="2" to-layer="323" to-port="0" />
<edge from-layer="322" from-port="0" to-layer="323" to-port="1" />
<edge from-layer="323" from-port="2" to-layer="325" to-port="0" />
<edge from-layer="324" from-port="0" to-layer="325" to-port="1" />
<edge from-layer="325" from-port="2" to-layer="326" to-port="0" />
<edge from-layer="326" from-port="1" to-layer="327" to-port="1" />
<edge from-layer="327" from-port="2" to-layer="328" to-port="1" />
<edge from-layer="328" from-port="2" to-layer="329" to-port="1" />
<edge from-layer="329" from-port="2" to-layer="331" to-port="0" />
<edge from-layer="329" from-port="2" to-layer="346" to-port="0" />
<edge from-layer="329" from-port="2" to-layer="337" to-port="0" />
<edge from-layer="330" from-port="0" to-layer="331" to-port="1" />
<edge from-layer="331" from-port="2" to-layer="333" to-port="0" />
<edge from-layer="332" from-port="0" to-layer="333" to-port="1" />
<edge from-layer="333" from-port="2" to-layer="335" to-port="0" />
<edge from-layer="334" from-port="0" to-layer="335" to-port="1" />
<edge from-layer="335" from-port="2" to-layer="342" to-port="0" />
<edge from-layer="336" from-port="0" to-layer="337" to-port="1" />
<edge from-layer="337" from-port="2" to-layer="339" to-port="0" />
<edge from-layer="338" from-port="0" to-layer="339" to-port="1" />
<edge from-layer="339" from-port="2" to-layer="341" to-port="0" />
<edge from-layer="340" from-port="0" to-layer="341" to-port="1" />
<edge from-layer="341" from-port="2" to-layer="342" to-port="1" />
<edge from-layer="342" from-port="2" to-layer="343" to-port="0" />
<edge from-layer="343" from-port="2" to-layer="344" to-port="0" />
<edge from-layer="344" from-port="1" to-layer="351" to-port="0" />
<edge from-layer="345" from-port="0" to-layer="346" to-port="1" />
<edge from-layer="346" from-port="2" to-layer="348" to-port="0" />
<edge from-layer="347" from-port="0" to-layer="348" to-port="1" />
<edge from-layer="348" from-port="2" to-layer="350" to-port="0" />
<edge from-layer="349" from-port="0" to-layer="350" to-port="1" />
<edge from-layer="350" from-port="2" to-layer="351" to-port="1" />
<edge from-layer="351" from-port="2" to-layer="353" to-port="0" />
<edge from-layer="352" from-port="0" to-layer="353" to-port="1" />
<edge from-layer="353" from-port="2" to-layer="355" to-port="0" />
<edge from-layer="354" from-port="0" to-layer="355" to-port="1" />
<edge from-layer="355" from-port="2" to-layer="357" to-port="0" />
<edge from-layer="356" from-port="0" to-layer="357" to-port="1" />
<edge from-layer="357" from-port="2" to-layer="358" to-port="1" />
<edge from-layer="358" from-port="2" to-layer="369" to-port="0" />
<edge from-layer="358" from-port="2" to-layer="362" to-port="0" />
<edge from-layer="358" from-port="2" to-layer="376" to-port="0" />
<edge from-layer="359" from-port="0" to-layer="370" to-port="0" />
<edge from-layer="360" from-port="0" to-layer="368" to-port="0" />
<edge from-layer="361" from-port="0" to-layer="362" to-port="1" />
<edge from-layer="362" from-port="2" to-layer="364" to-port="0" />
<edge from-layer="363" from-port="0" to-layer="364" to-port="1" />
<edge from-layer="364" from-port="2" to-layer="366" to-port="0" />
<edge from-layer="365" from-port="0" to-layer="366" to-port="1" />
<edge from-layer="366" from-port="2" to-layer="367" to-port="0" />
<edge from-layer="367" from-port="1" to-layer="368" to-port="1" />
<edge from-layer="368" from-port="2" to-layer="369" to-port="1" />
<edge from-layer="369" from-port="2" to-layer="370" to-port="1" />
<edge from-layer="370" from-port="2" to-layer="372" to-port="0" />
<edge from-layer="371" from-port="0" to-layer="372" to-port="1" />
<edge from-layer="372" from-port="2" to-layer="373" to-port="0" />
<edge from-layer="373" from-port="1" to-layer="375" to-port="0" />
<edge from-layer="374" from-port="0" to-layer="375" to-port="1" />
<edge from-layer="375" from-port="2" to-layer="376" to-port="1" />
<edge from-layer="376" from-port="2" to-layer="380" to-port="0" />
<edge from-layer="376" from-port="2" to-layer="417" to-port="0" />
<edge from-layer="376" from-port="2" to-layer="387" to-port="0" />
<edge from-layer="377" from-port="0" to-layer="388" to-port="0" />
<edge from-layer="378" from-port="0" to-layer="386" to-port="0" />
<edge from-layer="379" from-port="0" to-layer="380" to-port="1" />
<edge from-layer="380" from-port="2" to-layer="382" to-port="0" />
<edge from-layer="381" from-port="0" to-layer="382" to-port="1" />
<edge from-layer="382" from-port="2" to-layer="384" to-port="0" />
<edge from-layer="383" from-port="0" to-layer="384" to-port="1" />
<edge from-layer="384" from-port="2" to-layer="385" to-port="0" />
<edge from-layer="385" from-port="1" to-layer="386" to-port="1" />
<edge from-layer="386" from-port="2" to-layer="387" to-port="1" />
<edge from-layer="387" from-port="2" to-layer="388" to-port="1" />
<edge from-layer="388" from-port="2" to-layer="396" to-port="0" />
<edge from-layer="388" from-port="2" to-layer="405" to-port="0" />
<edge from-layer="388" from-port="2" to-layer="390" to-port="0" />
<edge from-layer="389" from-port="0" to-layer="390" to-port="1" />
<edge from-layer="390" from-port="2" to-layer="392" to-port="0" />
<edge from-layer="391" from-port="0" to-layer="392" to-port="1" />
<edge from-layer="392" from-port="2" to-layer="394" to-port="0" />
<edge from-layer="393" from-port="0" to-layer="394" to-port="1" />
<edge from-layer="394" from-port="2" to-layer="401" to-port="0" />
<edge from-layer="395" from-port="0" to-layer="396" to-port="1" />
<edge from-layer="396" from-port="2" to-layer="398" to-port="0" />
<edge from-layer="397" from-port="0" to-layer="398" to-port="1" />
<edge from-layer="398" from-port="2" to-layer="400" to-port="0" />
<edge from-layer="399" from-port="0" to-layer="400" to-port="1" />
<edge from-layer="400" from-port="2" to-layer="401" to-port="1" />
<edge from-layer="401" from-port="2" to-layer="402" to-port="0" />
<edge from-layer="402" from-port="2" to-layer="403" to-port="0" />
<edge from-layer="403" from-port="1" to-layer="410" to-port="0" />
<edge from-layer="404" from-port="0" to-layer="405" to-port="1" />
<edge from-layer="405" from-port="2" to-layer="407" to-port="0" />
<edge from-layer="406" from-port="0" to-layer="407" to-port="1" />
<edge from-layer="407" from-port="2" to-layer="409" to-port="0" />
<edge from-layer="408" from-port="0" to-layer="409" to-port="1" />
<edge from-layer="409" from-port="2" to-layer="410" to-port="1" />
<edge from-layer="410" from-port="2" to-layer="412" to-port="0" />
<edge from-layer="411" from-port="0" to-layer="412" to-port="1" />
<edge from-layer="412" from-port="2" to-layer="414" to-port="0" />
<edge from-layer="413" from-port="0" to-layer="414" to-port="1" />
<edge from-layer="414" from-port="2" to-layer="416" to-port="0" />
<edge from-layer="415" from-port="0" to-layer="416" to-port="1" />
<edge from-layer="416" from-port="2" to-layer="417" to-port="1" />
<edge from-layer="417" from-port="2" to-layer="421" to-port="0" />
<edge from-layer="417" from-port="2" to-layer="428" to-port="0" />
<edge from-layer="417" from-port="2" to-layer="435" to-port="0" />
<edge from-layer="418" from-port="0" to-layer="429" to-port="0" />
<edge from-layer="419" from-port="0" to-layer="427" to-port="0" />
<edge from-layer="420" from-port="0" to-layer="421" to-port="1" />
<edge from-layer="421" from-port="2" to-layer="423" to-port="0" />
<edge from-layer="422" from-port="0" to-layer="423" to-port="1" />
<edge from-layer="423" from-port="2" to-layer="425" to-port="0" />
<edge from-layer="424" from-port="0" to-layer="425" to-port="1" />
<edge from-layer="425" from-port="2" to-layer="426" to-port="0" />
<edge from-layer="426" from-port="1" to-layer="427" to-port="1" />
<edge from-layer="427" from-port="2" to-layer="428" to-port="1" />
<edge from-layer="428" from-port="2" to-layer="429" to-port="1" />
<edge from-layer="429" from-port="2" to-layer="431" to-port="0" />
<edge from-layer="430" from-port="0" to-layer="431" to-port="1" />
<edge from-layer="431" from-port="2" to-layer="432" to-port="0" />
<edge from-layer="432" from-port="1" to-layer="434" to-port="0" />
<edge from-layer="433" from-port="0" to-layer="434" to-port="1" />
<edge from-layer="434" from-port="2" to-layer="435" to-port="1" />
<edge from-layer="435" from-port="2" to-layer="476" to-port="0" />
<edge from-layer="435" from-port="2" to-layer="446" to-port="0" />
<edge from-layer="435" from-port="2" to-layer="439" to-port="0" />
<edge from-layer="436" from-port="0" to-layer="447" to-port="0" />
<edge from-layer="437" from-port="0" to-layer="445" to-port="0" />
<edge from-layer="438" from-port="0" to-layer="439" to-port="1" />
<edge from-layer="439" from-port="2" to-layer="441" to-port="0" />
<edge from-layer="440" from-port="0" to-layer="441" to-port="1" />
<edge from-layer="441" from-port="2" to-layer="443" to-port="0" />
<edge from-layer="442" from-port="0" to-layer="443" to-port="1" />
<edge from-layer="443" from-port="2" to-layer="444" to-port="0" />
<edge from-layer="444" from-port="1" to-layer="445" to-port="1" />
<edge from-layer="445" from-port="2" to-layer="446" to-port="1" />
<edge from-layer="446" from-port="2" to-layer="447" to-port="1" />
<edge from-layer="447" from-port="2" to-layer="455" to-port="0" />
<edge from-layer="447" from-port="2" to-layer="464" to-port="0" />
<edge from-layer="447" from-port="2" to-layer="449" to-port="0" />
<edge from-layer="448" from-port="0" to-layer="449" to-port="1" />
<edge from-layer="449" from-port="2" to-layer="451" to-port="0" />
<edge from-layer="450" from-port="0" to-layer="451" to-port="1" />
<edge from-layer="451" from-port="2" to-layer="453" to-port="0" />
<edge from-layer="452" from-port="0" to-layer="453" to-port="1" />
<edge from-layer="453" from-port="2" to-layer="460" to-port="0" />
<edge from-layer="454" from-port="0" to-layer="455" to-port="1" />
<edge from-layer="455" from-port="2" to-layer="457" to-port="0" />
<edge from-layer="456" from-port="0" to-layer="457" to-port="1" />
<edge from-layer="457" from-port="2" to-layer="459" to-port="0" />
<edge from-layer="458" from-port="0" to-layer="459" to-port="1" />
<edge from-layer="459" from-port="2" to-layer="460" to-port="1" />
<edge from-layer="460" from-port="2" to-layer="461" to-port="0" />
<edge from-layer="461" from-port="2" to-layer="462" to-port="0" />
<edge from-layer="462" from-port="1" to-layer="469" to-port="0" />
<edge from-layer="463" from-port="0" to-layer="464" to-port="1" />
<edge from-layer="464" from-port="2" to-layer="466" to-port="0" />
<edge from-layer="465" from-port="0" to-layer="466" to-port="1" />
<edge from-layer="466" from-port="2" to-layer="468" to-port="0" />
<edge from-layer="467" from-port="0" to-layer="468" to-port="1" />
<edge from-layer="468" from-port="2" to-layer="469" to-port="1" />
<edge from-layer="469" from-port="2" to-layer="471" to-port="0" />
<edge from-layer="470" from-port="0" to-layer="471" to-port="1" />
<edge from-layer="471" from-port="2" to-layer="473" to-port="0" />
<edge from-layer="472" from-port="0" to-layer="473" to-port="1" />
<edge from-layer="473" from-port="2" to-layer="475" to-port="0" />
<edge from-layer="474" from-port="0" to-layer="475" to-port="1" />
<edge from-layer="475" from-port="2" to-layer="476" to-port="1" />
<edge from-layer="476" from-port="2" to-layer="487" to-port="0" />
<edge from-layer="476" from-port="2" to-layer="494" to-port="0" />
<edge from-layer="476" from-port="2" to-layer="480" to-port="0" />
<edge from-layer="477" from-port="0" to-layer="488" to-port="0" />
<edge from-layer="478" from-port="0" to-layer="486" to-port="0" />
<edge from-layer="479" from-port="0" to-layer="480" to-port="1" />
<edge from-layer="480" from-port="2" to-layer="482" to-port="0" />
<edge from-layer="481" from-port="0" to-layer="482" to-port="1" />
<edge from-layer="482" from-port="2" to-layer="484" to-port="0" />
<edge from-layer="483" from-port="0" to-layer="484" to-port="1" />
<edge from-layer="484" from-port="2" to-layer="485" to-port="0" />
<edge from-layer="485" from-port="1" to-layer="486" to-port="1" />
<edge from-layer="486" from-port="2" to-layer="487" to-port="1" />
<edge from-layer="487" from-port="2" to-layer="488" to-port="1" />
<edge from-layer="488" from-port="2" to-layer="490" to-port="0" />
<edge from-layer="489" from-port="0" to-layer="490" to-port="1" />
<edge from-layer="490" from-port="2" to-layer="491" to-port="0" />
<edge from-layer="491" from-port="1" to-layer="493" to-port="0" />
<edge from-layer="492" from-port="0" to-layer="493" to-port="1" />
<edge from-layer="493" from-port="2" to-layer="494" to-port="1" />
<edge from-layer="494" from-port="2" to-layer="535" to-port="0" />
<edge from-layer="494" from-port="2" to-layer="498" to-port="0" />
<edge from-layer="494" from-port="2" to-layer="505" to-port="0" />
<edge from-layer="495" from-port="0" to-layer="506" to-port="0" />
<edge from-layer="496" from-port="0" to-layer="504" to-port="0" />
<edge from-layer="497" from-port="0" to-layer="498" to-port="1" />
<edge from-layer="498" from-port="2" to-layer="500" to-port="0" />
<edge from-layer="499" from-port="0" to-layer="500" to-port="1" />
<edge from-layer="500" from-port="2" to-layer="502" to-port="0" />
<edge from-layer="501" from-port="0" to-layer="502" to-port="1" />
<edge from-layer="502" from-port="2" to-layer="503" to-port="0" />
<edge from-layer="503" from-port="1" to-layer="504" to-port="1" />
<edge from-layer="504" from-port="2" to-layer="505" to-port="1" />
<edge from-layer="505" from-port="2" to-layer="506" to-port="1" />
<edge from-layer="506" from-port="2" to-layer="523" to-port="0" />
<edge from-layer="506" from-port="2" to-layer="514" to-port="0" />
<edge from-layer="506" from-port="2" to-layer="508" to-port="0" />
<edge from-layer="507" from-port="0" to-layer="508" to-port="1" />
<edge from-layer="508" from-port="2" to-layer="510" to-port="0" />
<edge from-layer="509" from-port="0" to-layer="510" to-port="1" />
<edge from-layer="510" from-port="2" to-layer="512" to-port="0" />
<edge from-layer="511" from-port="0" to-layer="512" to-port="1" />
<edge from-layer="512" from-port="2" to-layer="519" to-port="0" />
<edge from-layer="513" from-port="0" to-layer="514" to-port="1" />
<edge from-layer="514" from-port="2" to-layer="516" to-port="0" />
<edge from-layer="515" from-port="0" to-layer="516" to-port="1" />
<edge from-layer="516" from-port="2" to-layer="518" to-port="0" />
<edge from-layer="517" from-port="0" to-layer="518" to-port="1" />
<edge from-layer="518" from-port="2" to-layer="519" to-port="1" />
<edge from-layer="519" from-port="2" to-layer="520" to-port="0" />
<edge from-layer="520" from-port="2" to-layer="521" to-port="0" />
<edge from-layer="521" from-port="1" to-layer="528" to-port="0" />
<edge from-layer="522" from-port="0" to-layer="523" to-port="1" />
<edge from-layer="523" from-port="2" to-layer="525" to-port="0" />
<edge from-layer="524" from-port="0" to-layer="525" to-port="1" />
<edge from-layer="525" from-port="2" to-layer="527" to-port="0" />
<edge from-layer="526" from-port="0" to-layer="527" to-port="1" />
<edge from-layer="527" from-port="2" to-layer="528" to-port="1" />
<edge from-layer="528" from-port="2" to-layer="530" to-port="0" />
<edge from-layer="529" from-port="0" to-layer="530" to-port="1" />
<edge from-layer="530" from-port="2" to-layer="532" to-port="0" />
<edge from-layer="531" from-port="0" to-layer="532" to-port="1" />
<edge from-layer="532" from-port="2" to-layer="534" to-port="0" />
<edge from-layer="533" from-port="0" to-layer="534" to-port="1" />
<edge from-layer="534" from-port="2" to-layer="535" to-port="1" />
<edge from-layer="535" from-port="2" to-layer="553" to-port="0" />
<edge from-layer="535" from-port="2" to-layer="546" to-port="0" />
<edge from-layer="535" from-port="2" to-layer="539" to-port="0" />
<edge from-layer="536" from-port="0" to-layer="547" to-port="0" />
<edge from-layer="537" from-port="0" to-layer="545" to-port="0" />
<edge from-layer="538" from-port="0" to-layer="539" to-port="1" />
<edge from-layer="539" from-port="2" to-layer="541" to-port="0" />
<edge from-layer="540" from-port="0" to-layer="541" to-port="1" />
<edge from-layer="541" from-port="2" to-layer="543" to-port="0" />
<edge from-layer="542" from-port="0" to-layer="543" to-port="1" />
<edge from-layer="543" from-port="2" to-layer="544" to-port="0" />
<edge from-layer="544" from-port="1" to-layer="545" to-port="1" />
<edge from-layer="545" from-port="2" to-layer="546" to-port="1" />
<edge from-layer="546" from-port="2" to-layer="547" to-port="1" />
<edge from-layer="547" from-port="2" to-layer="549" to-port="0" />
<edge from-layer="548" from-port="0" to-layer="549" to-port="1" />
<edge from-layer="549" from-port="2" to-layer="550" to-port="0" />
<edge from-layer="550" from-port="1" to-layer="552" to-port="0" />
<edge from-layer="551" from-port="0" to-layer="552" to-port="1" />
<edge from-layer="552" from-port="2" to-layer="553" to-port="1" />
<edge from-layer="553" from-port="2" to-layer="594" to-port="0" />
<edge from-layer="553" from-port="2" to-layer="564" to-port="0" />
<edge from-layer="553" from-port="2" to-layer="557" to-port="0" />
<edge from-layer="554" from-port="0" to-layer="565" to-port="0" />
<edge from-layer="555" from-port="0" to-layer="563" to-port="0" />
<edge from-layer="556" from-port="0" to-layer="557" to-port="1" />
<edge from-layer="557" from-port="2" to-layer="559" to-port="0" />
<edge from-layer="558" from-port="0" to-layer="559" to-port="1" />
<edge from-layer="559" from-port="2" to-layer="561" to-port="0" />
<edge from-layer="560" from-port="0" to-layer="561" to-port="1" />
<edge from-layer="561" from-port="2" to-layer="562" to-port="0" />
<edge from-layer="562" from-port="1" to-layer="563" to-port="1" />
<edge from-layer="563" from-port="2" to-layer="564" to-port="1" />
<edge from-layer="564" from-port="2" to-layer="565" to-port="1" />
<edge from-layer="565" from-port="2" to-layer="573" to-port="0" />
<edge from-layer="565" from-port="2" to-layer="567" to-port="0" />
<edge from-layer="565" from-port="2" to-layer="582" to-port="0" />
<edge from-layer="566" from-port="0" to-layer="567" to-port="1" />
<edge from-layer="567" from-port="2" to-layer="569" to-port="0" />
<edge from-layer="568" from-port="0" to-layer="569" to-port="1" />
<edge from-layer="569" from-port="2" to-layer="571" to-port="0" />
<edge from-layer="570" from-port="0" to-layer="571" to-port="1" />
<edge from-layer="571" from-port="2" to-layer="578" to-port="0" />
<edge from-layer="572" from-port="0" to-layer="573" to-port="1" />
<edge from-layer="573" from-port="2" to-layer="575" to-port="0" />
<edge from-layer="574" from-port="0" to-layer="575" to-port="1" />
<edge from-layer="575" from-port="2" to-layer="577" to-port="0" />
<edge from-layer="576" from-port="0" to-layer="577" to-port="1" />
<edge from-layer="577" from-port="2" to-layer="578" to-port="1" />
<edge from-layer="578" from-port="2" to-layer="579" to-port="0" />
<edge from-layer="579" from-port="2" to-layer="580" to-port="0" />
<edge from-layer="580" from-port="1" to-layer="587" to-port="0" />
<edge from-layer="581" from-port="0" to-layer="582" to-port="1" />
<edge from-layer="582" from-port="2" to-layer="584" to-port="0" />
<edge from-layer="583" from-port="0" to-layer="584" to-port="1" />
<edge from-layer="584" from-port="2" to-layer="586" to-port="0" />
<edge from-layer="585" from-port="0" to-layer="586" to-port="1" />
<edge from-layer="586" from-port="2" to-layer="587" to-port="1" />
<edge from-layer="587" from-port="2" to-layer="589" to-port="0" />
<edge from-layer="588" from-port="0" to-layer="589" to-port="1" />
<edge from-layer="589" from-port="2" to-layer="591" to-port="0" />
<edge from-layer="590" from-port="0" to-layer="591" to-port="1" />
<edge from-layer="591" from-port="2" to-layer="593" to-port="0" />
<edge from-layer="592" from-port="0" to-layer="593" to-port="1" />
<edge from-layer="593" from-port="2" to-layer="594" to-port="1" />
<edge from-layer="594" from-port="2" to-layer="612" to-port="0" />
<edge from-layer="594" from-port="2" to-layer="598" to-port="0" />
<edge from-layer="594" from-port="2" to-layer="605" to-port="0" />
<edge from-layer="595" from-port="0" to-layer="606" to-port="0" />
<edge from-layer="596" from-port="0" to-layer="604" to-port="0" />
<edge from-layer="597" from-port="0" to-layer="598" to-port="1" />
<edge from-layer="598" from-port="2" to-layer="600" to-port="0" />
<edge from-layer="599" from-port="0" to-layer="600" to-port="1" />
<edge from-layer="600" from-port="2" to-layer="602" to-port="0" />
<edge from-layer="601" from-port="0" to-layer="602" to-port="1" />
<edge from-layer="602" from-port="2" to-layer="603" to-port="0" />
<edge from-layer="603" from-port="1" to-layer="604" to-port="1" />
<edge from-layer="604" from-port="2" to-layer="605" to-port="1" />
<edge from-layer="605" from-port="2" to-layer="606" to-port="1" />
<edge from-layer="606" from-port="2" to-layer="608" to-port="0" />
<edge from-layer="607" from-port="0" to-layer="608" to-port="1" />
<edge from-layer="608" from-port="2" to-layer="609" to-port="0" />
<edge from-layer="609" from-port="1" to-layer="611" to-port="0" />
<edge from-layer="610" from-port="0" to-layer="611" to-port="1" />
<edge from-layer="611" from-port="2" to-layer="612" to-port="1" />
<edge from-layer="612" from-port="2" to-layer="623" to-port="0" />
<edge from-layer="612" from-port="2" to-layer="653" to-port="0" />
<edge from-layer="612" from-port="2" to-layer="616" to-port="0" />
<edge from-layer="613" from-port="0" to-layer="624" to-port="0" />
<edge from-layer="614" from-port="0" to-layer="622" to-port="0" />
<edge from-layer="615" from-port="0" to-layer="616" to-port="1" />
<edge from-layer="616" from-port="2" to-layer="618" to-port="0" />
<edge from-layer="617" from-port="0" to-layer="618" to-port="1" />
<edge from-layer="618" from-port="2" to-layer="620" to-port="0" />
<edge from-layer="619" from-port="0" to-layer="620" to-port="1" />
<edge from-layer="620" from-port="2" to-layer="621" to-port="0" />
<edge from-layer="621" from-port="1" to-layer="622" to-port="1" />
<edge from-layer="622" from-port="2" to-layer="623" to-port="1" />
<edge from-layer="623" from-port="2" to-layer="624" to-port="1" />
<edge from-layer="624" from-port="2" to-layer="641" to-port="0" />
<edge from-layer="624" from-port="2" to-layer="632" to-port="0" />
<edge from-layer="624" from-port="2" to-layer="626" to-port="0" />
<edge from-layer="625" from-port="0" to-layer="626" to-port="1" />
<edge from-layer="626" from-port="2" to-layer="628" to-port="0" />
<edge from-layer="627" from-port="0" to-layer="628" to-port="1" />
<edge from-layer="628" from-port="2" to-layer="630" to-port="0" />
<edge from-layer="629" from-port="0" to-layer="630" to-port="1" />
<edge from-layer="630" from-port="2" to-layer="637" to-port="0" />
<edge from-layer="631" from-port="0" to-layer="632" to-port="1" />
<edge from-layer="632" from-port="2" to-layer="634" to-port="0" />
<edge from-layer="633" from-port="0" to-layer="634" to-port="1" />
<edge from-layer="634" from-port="2" to-layer="636" to-port="0" />
<edge from-layer="635" from-port="0" to-layer="636" to-port="1" />
<edge from-layer="636" from-port="2" to-layer="637" to-port="1" />
<edge from-layer="637" from-port="2" to-layer="638" to-port="0" />
<edge from-layer="638" from-port="2" to-layer="639" to-port="0" />
<edge from-layer="639" from-port="1" to-layer="646" to-port="0" />
<edge from-layer="640" from-port="0" to-layer="641" to-port="1" />
<edge from-layer="641" from-port="2" to-layer="643" to-port="0" />
<edge from-layer="642" from-port="0" to-layer="643" to-port="1" />
<edge from-layer="643" from-port="2" to-layer="645" to-port="0" />
<edge from-layer="644" from-port="0" to-layer="645" to-port="1" />
<edge from-layer="645" from-port="2" to-layer="646" to-port="1" />
<edge from-layer="646" from-port="2" to-layer="648" to-port="0" />
<edge from-layer="647" from-port="0" to-layer="648" to-port="1" />
<edge from-layer="648" from-port="2" to-layer="650" to-port="0" />
<edge from-layer="649" from-port="0" to-layer="650" to-port="1" />
<edge from-layer="650" from-port="2" to-layer="652" to-port="0" />
<edge from-layer="651" from-port="0" to-layer="652" to-port="1" />
<edge from-layer="652" from-port="2" to-layer="653" to-port="1" />
<edge from-layer="653" from-port="2" to-layer="657" to-port="0" />
<edge from-layer="653" from-port="2" to-layer="664" to-port="0" />
<edge from-layer="653" from-port="2" to-layer="671" to-port="0" />
<edge from-layer="654" from-port="0" to-layer="665" to-port="0" />
<edge from-layer="655" from-port="0" to-layer="663" to-port="0" />
<edge from-layer="656" from-port="0" to-layer="657" to-port="1" />
<edge from-layer="657" from-port="2" to-layer="659" to-port="0" />
<edge from-layer="658" from-port="0" to-layer="659" to-port="1" />
<edge from-layer="659" from-port="2" to-layer="661" to-port="0" />
<edge from-layer="660" from-port="0" to-layer="661" to-port="1" />
<edge from-layer="661" from-port="2" to-layer="662" to-port="0" />
<edge from-layer="662" from-port="1" to-layer="663" to-port="1" />
<edge from-layer="663" from-port="2" to-layer="664" to-port="1" />
<edge from-layer="664" from-port="2" to-layer="665" to-port="1" />
<edge from-layer="665" from-port="2" to-layer="667" to-port="0" />
<edge from-layer="666" from-port="0" to-layer="667" to-port="1" />
<edge from-layer="667" from-port="2" to-layer="668" to-port="0" />
<edge from-layer="668" from-port="1" to-layer="670" to-port="0" />
<edge from-layer="669" from-port="0" to-layer="670" to-port="1" />
<edge from-layer="670" from-port="2" to-layer="671" to-port="1" />
<edge from-layer="671" from-port="2" to-layer="712" to-port="0" />
<edge from-layer="671" from-port="2" to-layer="682" to-port="0" />
<edge from-layer="671" from-port="2" to-layer="675" to-port="0" />
<edge from-layer="672" from-port="0" to-layer="683" to-port="0" />
<edge from-layer="673" from-port="0" to-layer="681" to-port="0" />
<edge from-layer="674" from-port="0" to-layer="675" to-port="1" />
<edge from-layer="675" from-port="2" to-layer="677" to-port="0" />
<edge from-layer="676" from-port="0" to-layer="677" to-port="1" />
<edge from-layer="677" from-port="2" to-layer="679" to-port="0" />
<edge from-layer="678" from-port="0" to-layer="679" to-port="1" />
<edge from-layer="679" from-port="2" to-layer="680" to-port="0" />
<edge from-layer="680" from-port="1" to-layer="681" to-port="1" />
<edge from-layer="681" from-port="2" to-layer="682" to-port="1" />
<edge from-layer="682" from-port="2" to-layer="683" to-port="1" />
<edge from-layer="683" from-port="2" to-layer="685" to-port="0" />
<edge from-layer="683" from-port="2" to-layer="700" to-port="0" />
<edge from-layer="683" from-port="2" to-layer="691" to-port="0" />
<edge from-layer="684" from-port="0" to-layer="685" to-port="1" />
<edge from-layer="685" from-port="2" to-layer="687" to-port="0" />
<edge from-layer="686" from-port="0" to-layer="687" to-port="1" />
<edge from-layer="687" from-port="2" to-layer="689" to-port="0" />
<edge from-layer="688" from-port="0" to-layer="689" to-port="1" />
<edge from-layer="689" from-port="2" to-layer="696" to-port="0" />
<edge from-layer="690" from-port="0" to-layer="691" to-port="1" />
<edge from-layer="691" from-port="2" to-layer="693" to-port="0" />
<edge from-layer="692" from-port="0" to-layer="693" to-port="1" />
<edge from-layer="693" from-port="2" to-layer="695" to-port="0" />
<edge from-layer="694" from-port="0" to-layer="695" to-port="1" />
<edge from-layer="695" from-port="2" to-layer="696" to-port="1" />
<edge from-layer="696" from-port="2" to-layer="697" to-port="0" />
<edge from-layer="697" from-port="2" to-layer="698" to-port="0" />
<edge from-layer="698" from-port="1" to-layer="705" to-port="0" />
<edge from-layer="699" from-port="0" to-layer="700" to-port="1" />
<edge from-layer="700" from-port="2" to-layer="702" to-port="0" />
<edge from-layer="701" from-port="0" to-layer="702" to-port="1" />
<edge from-layer="702" from-port="2" to-layer="704" to-port="0" />
<edge from-layer="703" from-port="0" to-layer="704" to-port="1" />
<edge from-layer="704" from-port="2" to-layer="705" to-port="1" />
<edge from-layer="705" from-port="2" to-layer="707" to-port="0" />
<edge from-layer="706" from-port="0" to-layer="707" to-port="1" />
<edge from-layer="707" from-port="2" to-layer="709" to-port="0" />
<edge from-layer="708" from-port="0" to-layer="709" to-port="1" />
<edge from-layer="709" from-port="2" to-layer="711" to-port="0" />
<edge from-layer="710" from-port="0" to-layer="711" to-port="1" />
<edge from-layer="711" from-port="2" to-layer="712" to-port="1" />
<edge from-layer="712" from-port="2" to-layer="716" to-port="0" />
<edge from-layer="712" from-port="2" to-layer="730" to-port="0" />
<edge from-layer="712" from-port="2" to-layer="723" to-port="0" />
<edge from-layer="713" from-port="0" to-layer="724" to-port="0" />
<edge from-layer="714" from-port="0" to-layer="722" to-port="0" />
<edge from-layer="715" from-port="0" to-layer="716" to-port="1" />
<edge from-layer="716" from-port="2" to-layer="718" to-port="0" />
<edge from-layer="717" from-port="0" to-layer="718" to-port="1" />
<edge from-layer="718" from-port="2" to-layer="720" to-port="0" />
<edge from-layer="719" from-port="0" to-layer="720" to-port="1" />
<edge from-layer="720" from-port="2" to-layer="721" to-port="0" />
<edge from-layer="721" from-port="1" to-layer="722" to-port="1" />
<edge from-layer="722" from-port="2" to-layer="723" to-port="1" />
<edge from-layer="723" from-port="2" to-layer="724" to-port="1" />
<edge from-layer="724" from-port="2" to-layer="726" to-port="0" />
<edge from-layer="725" from-port="0" to-layer="726" to-port="1" />
<edge from-layer="726" from-port="2" to-layer="727" to-port="0" />
<edge from-layer="727" from-port="1" to-layer="729" to-port="0" />
<edge from-layer="728" from-port="0" to-layer="729" to-port="1" />
<edge from-layer="729" from-port="2" to-layer="730" to-port="1" />
<edge from-layer="730" from-port="2" to-layer="741" to-port="0" />
<edge from-layer="730" from-port="2" to-layer="771" to-port="0" />
<edge from-layer="730" from-port="2" to-layer="734" to-port="0" />
<edge from-layer="731" from-port="0" to-layer="742" to-port="0" />
<edge from-layer="732" from-port="0" to-layer="740" to-port="0" />
<edge from-layer="733" from-port="0" to-layer="734" to-port="1" />
<edge from-layer="734" from-port="2" to-layer="736" to-port="0" />
<edge from-layer="735" from-port="0" to-layer="736" to-port="1" />
<edge from-layer="736" from-port="2" to-layer="738" to-port="0" />
<edge from-layer="737" from-port="0" to-layer="738" to-port="1" />
<edge from-layer="738" from-port="2" to-layer="739" to-port="0" />
<edge from-layer="739" from-port="1" to-layer="740" to-port="1" />
<edge from-layer="740" from-port="2" to-layer="741" to-port="1" />
<edge from-layer="741" from-port="2" to-layer="742" to-port="1" />
<edge from-layer="742" from-port="2" to-layer="759" to-port="0" />
<edge from-layer="742" from-port="2" to-layer="750" to-port="0" />
<edge from-layer="742" from-port="2" to-layer="744" to-port="0" />
<edge from-layer="743" from-port="0" to-layer="744" to-port="1" />
<edge from-layer="744" from-port="2" to-layer="746" to-port="0" />
<edge from-layer="745" from-port="0" to-layer="746" to-port="1" />
<edge from-layer="746" from-port="2" to-layer="748" to-port="0" />
<edge from-layer="747" from-port="0" to-layer="748" to-port="1" />
<edge from-layer="748" from-port="2" to-layer="755" to-port="0" />
<edge from-layer="749" from-port="0" to-layer="750" to-port="1" />
<edge from-layer="750" from-port="2" to-layer="752" to-port="0" />
<edge from-layer="751" from-port="0" to-layer="752" to-port="1" />
<edge from-layer="752" from-port="2" to-layer="754" to-port="0" />
<edge from-layer="753" from-port="0" to-layer="754" to-port="1" />
<edge from-layer="754" from-port="2" to-layer="755" to-port="1" />
<edge from-layer="755" from-port="2" to-layer="756" to-port="0" />
<edge from-layer="756" from-port="2" to-layer="757" to-port="0" />
<edge from-layer="757" from-port="1" to-layer="764" to-port="0" />
<edge from-layer="758" from-port="0" to-layer="759" to-port="1" />
<edge from-layer="759" from-port="2" to-layer="761" to-port="0" />
<edge from-layer="760" from-port="0" to-layer="761" to-port="1" />
<edge from-layer="761" from-port="2" to-layer="763" to-port="0" />
<edge from-layer="762" from-port="0" to-layer="763" to-port="1" />
<edge from-layer="763" from-port="2" to-layer="764" to-port="1" />
<edge from-layer="764" from-port="2" to-layer="766" to-port="0" />
<edge from-layer="765" from-port="0" to-layer="766" to-port="1" />
<edge from-layer="766" from-port="2" to-layer="768" to-port="0" />
<edge from-layer="767" from-port="0" to-layer="768" to-port="1" />
<edge from-layer="768" from-port="2" to-layer="770" to-port="0" />
<edge from-layer="769" from-port="0" to-layer="770" to-port="1" />
<edge from-layer="770" from-port="2" to-layer="771" to-port="1" />
<edge from-layer="771" from-port="2" to-layer="775" to-port="0" />
<edge from-layer="771" from-port="2" to-layer="789" to-port="0" />
<edge from-layer="771" from-port="2" to-layer="782" to-port="0" />
<edge from-layer="772" from-port="0" to-layer="783" to-port="0" />
<edge from-layer="773" from-port="0" to-layer="781" to-port="0" />
<edge from-layer="774" from-port="0" to-layer="775" to-port="1" />
<edge from-layer="775" from-port="2" to-layer="777" to-port="0" />
<edge from-layer="776" from-port="0" to-layer="777" to-port="1" />
<edge from-layer="777" from-port="2" to-layer="779" to-port="0" />
<edge from-layer="778" from-port="0" to-layer="779" to-port="1" />
<edge from-layer="779" from-port="2" to-layer="780" to-port="0" />
<edge from-layer="780" from-port="1" to-layer="781" to-port="1" />
<edge from-layer="781" from-port="2" to-layer="782" to-port="1" />
<edge from-layer="782" from-port="2" to-layer="783" to-port="1" />
<edge from-layer="783" from-port="2" to-layer="785" to-port="0" />
<edge from-layer="784" from-port="0" to-layer="785" to-port="1" />
<edge from-layer="785" from-port="2" to-layer="786" to-port="0" />
<edge from-layer="786" from-port="1" to-layer="788" to-port="0" />
<edge from-layer="787" from-port="0" to-layer="788" to-port="1" />
<edge from-layer="788" from-port="2" to-layer="789" to-port="1" />
<edge from-layer="789" from-port="2" to-layer="792" to-port="0" />
<edge from-layer="789" from-port="2" to-layer="799" to-port="0" />
<edge from-layer="790" from-port="0" to-layer="798" to-port="0" />
<edge from-layer="791" from-port="0" to-layer="792" to-port="1" />
<edge from-layer="792" from-port="2" to-layer="794" to-port="0" />
<edge from-layer="793" from-port="0" to-layer="794" to-port="1" />
<edge from-layer="794" from-port="2" to-layer="796" to-port="0" />
<edge from-layer="795" from-port="0" to-layer="796" to-port="1" />
<edge from-layer="796" from-port="2" to-layer="797" to-port="0" />
<edge from-layer="797" from-port="1" to-layer="798" to-port="1" />
<edge from-layer="798" from-port="2" to-layer="799" to-port="1" />
<edge from-layer="799" from-port="2" to-layer="800" to-port="1" />
<edge from-layer="800" from-port="2" to-layer="801" to-port="0" />
</edges>
<rt_info>
<Runtime_version value="2025.2.0-19140-c01cd93e24d-releases/2025/2" />
<conversion_parameters>
<framework value="pytorch" />
<is_python_object value="True" />
</conversion_parameters>
<optimum>
<optimum_intel_version value="1.25.2" />
<optimum_version value="1.27.0" />
<pytorch_version value="2.7.1" />
<transformers_version value="4.53.3" />
</optimum>
<runtime_options>
<ACTIVATIONS_SCALE_FACTOR value="8.0" />
<KV_CACHE_PRECISION value="f16" />
</runtime_options>
</rt_info>
</net>