当前位置: 首页 > news >正文

用dw做网站结构图国内优秀网站

用dw做网站结构图,国内优秀网站,佛山网站建设哪家便宜,小贷网站需要多少钱可以做查询(q_proj)、键(k_proj)和值(v_proj)投影,这些投影是自注意力机制的核心组件,特别是在Transformer架构中。 让我们通过一个简化的例子来说明: import numpy as np# 假设输入维度是4,注意力头数是2 input_dim 4 num_heads 2 …

查询(q_proj)、键(k_proj)和值(v_proj)投影,这些投影是自注意力机制的核心组件,特别是在Transformer架构中。

让我们通过一个简化的例子来说明:

import numpy as np# 假设输入维度是4,注意力头数是2
input_dim = 4
num_heads = 2
head_dim = input_dim // num_heads# 模拟输入序列
x = np.random.randn(1, 3, input_dim)  # (batch_size, seq_len, input_dim)# 初始化投影矩阵
W_q = np.random.randn(input_dim, input_dim)
W_k = np.random.randn(input_dim, input_dim)
W_v = np.random.randn(input_dim, input_dim)# 执行投影
q = np.dot(x, W_q)  # 查询投影
k = np.dot(x, W_k)  # 键投影
v = np.dot(x, W_v)  # 值投影# 重塑以分离注意力头
q = q.reshape(1, 3, num_heads, head_dim)
k = k.reshape(1, 3, num_heads, head_dim)
v = v.reshape(1, 3, num_heads, head_dim)# 计算注意力分数
attention_scores = np.einsum('bhid,bhjd->bhij', q, k) / np.sqrt(head_dim)# 应用softmax
attention_probs = np.exp(attention_scores) / np.sum(np.exp(attention_scores), axis=-1, keepdims=True)# 计算输出
output = np.einsum('bhij,bhjd->bhid', attention_probs, v)print("Query shape:", q.shape)
print("Key shape:", k.shape)
print("Value shape:", v.shape)
print("Output shape:", output.shape)

解释如下:

  1. 查询(q_proj)、键(k_proj)和值(v_proj)投影:

    • 这些投影是线性变换,将输入向量映射到不同的表示空间。
    • 在代码中,它们由W_q、W_k和W_v矩阵表示。
    • 投影操作通过矩阵乘法实现:np.dot(x, W_q)等。
  2. 投影的作用:

    • 查询(q):用于与键进行比较,确定关注哪些部分。
    • 键(k):用于与查询匹配,帮助模型决定信息的重要性。
    • 值(v):包含实际的信息内容,根据注意力权重进行聚合。
  3. 多头注意力:

    • 投影后的向量被重塑为多个头,每个头独立计算注意力。
    • 这允许模型同时关注不同的表示子空间。
  4. 注意力计算:

    • 使用查询和键计算注意力分数。
    • 应用softmax得到注意力概率。
    • 使用这些概率对值进行加权求和,得到最终输出。

这个例子展示了自注意力机制的核心操作。在实际的Transformer模型中,这个过程会在多个层中重复进行,每一层都有自己的投影矩阵。

通过这些投影,模型能够学习到输入序列中的复杂关系和依赖,这对于处理各种序列任务(如自然语言处理)非常有效。

如果您想进一步了解这些投影在特定任务中的作用,或者探讨如何优化它们,我很乐意继续讨论。

http://www.yayakq.cn/news/988279/

相关文章:

  • 网站首页添加标签soe标题打开直接显示网站怎么做
  • 博罗网站建设出口网站制作
  • 有关网站建设的合同沈阳公司建站
  • 做响应式网站的体会互联网公司排名保定
  • 公司申请网站需要哪些材料网站开发体系
  • 建网站需要注册公司吗编程是什么东西
  • asp网站新闻置顶wordpress 建立数据库连接时出错 用户名密码可能不正确
  • 做了微网站sem优化方法
  • 南京网站设计我选柚米科技拉销智能模板建站系统
  • 做微商城网站免费做网站的公司
  • 英文公司网站图片发到哪些网站 seo
  • 做彩票平台网站吗沈阳建设工程交易中心官网
  • 深圳建设局网站宝安分中心wordpress图片加链接地址
  • 室内设计欣赏网站500人企业的网络搭建
  • 建设银行网站能变更手机号吗东莞服务公司网站建设
  • 百度网站检测dw网页制作教程宣传
  • 山西设计网站公司个人网站平台搭建
  • 网站怎么做分时深圳宝安区必去景点
  • 做直播大秀的平台和网站百度一下 你就知道首页官网
  • 网站维护电话电子商务网站建设及维护管理
  • 宏信网络网站建设网站专题模板下载
  • 成都淘宝网站建设怎么做网站表白
  • 橙云网站建设论坛类网站设计
  • 妇产医院网站源码个人简历模板免费下载网站
  • 网站开发及后期维护idc机房
  • 婚礼策划师wordpress怎么优化图片
  • 邯郸购物网站建设oa系统品牌
  • 河南省住房建设厅网站企业招聘网
  • 网站规划建设与管理维护课后答案6网站导航自适应
  • python做网站快么深圳知名网站设计公司