Commit 7358296b authored by higgsfield's avatar higgsfield Committed by Myle Ott
Browse files

fixed output_proj's input_dim in attention (#226)

parent 28adb200
Loading
Loading
Loading
Loading
+1 −1
Changes for fairseq/models/lstm.py: 1 added line, 1 removed line.
Original line number Diff line number Diff line
@@ -217,7 +217,7 @@ class AttentionLayer(nn.Module):
        super().__init__()

        self.input_proj = Linear(input_embed_dim, output_embed_dim, bias=False)
        self.output_proj = Linear(2*output_embed_dim, output_embed_dim, bias=False)
        self.output_proj = Linear(input_embed_dim + output_embed_dim, output_embed_dim, bias=False)

    def forward(self, input, source_hids, encoder_padding_mask):
        # input: bsz x input_embed_dim