Question on Your Paper: Clarification of Equation 5 in "Visual Feature Enhancer"
Hi,@LHY-HongyangLi .
I am currently studying your paper, and I have some questions regarding Section 3.4, "Visual Feature Enhancer." Specifically, I am curious about how Equation 5 demonstrates cross-attention. Additionally, if DFA2D is equivalent to cross-attention, could you please clarify what roles q and kv play in this context?

Thank you very much for your assistance!
关闭于 2024-09-09 2 条评论