禾风hefeng
码龄5年
求更新 关注
提问 私信
  • 博客:346,861
    社区:81
    346,942
    总访问量
  • 217
    原创
  • 6,340
    粉丝
  • 78
    关注
IP属地以运营商信息为准,境内显示到省(区、市),境外显示到国家(地区)
IP 属地:韩国
加入CSDN时间: 2021-09-28

个人简介:北京邮电大学本科生

博客简介:

weixin_62403234的博客

查看详细资料
个人成就
  • 获得2,889次点赞
  • 内容获得22次评论
  • 获得3,013次收藏
  • 代码片获得1,800次分享
  • 博客总排名116,439名
  • 原力等级
    原力等级
    6
    原力分
    2,072
    本月获得
    4
创作历程
  • 28篇
    2025年
  • 128篇
    2024年
  • 19篇
    2023年
  • 43篇
    2022年
成就勋章
TA的专栏
  • 机器学习
    59篇
  • 语义通信
    23篇
  • 抽象代数
    2篇
  • 现代通信技术
    30篇
  • 语义通信-文献阅读
    1篇
  • 通信原理
    10篇
  • 程序设计与算法
    39篇
  • 光纤通信
    2篇
  • 数学建模
    15篇
  • 微波
    12篇
  • 高级程序设计
    7篇
  • Arduino
    5篇

TA关注的专栏 4

TA关注的收藏夹 0

TA关注的社区 9

TA参与的活动 2

兴趣领域 设置
  • Python
    python
  • 人工智能
    人工智能
  • 网络与通信
    信息与通信
创作活动更多

编程达人挑战赛·第12期

作为写代码的你,是否也渴望被更多人看到?技术人员普遍有一个共性——明明技术很强,却没人知道你做了什么;花了很多时间踩坑,却没人因你少走弯路;脑子里有一堆干货,但却不懂如何有效地输出。 在如今写代码的人越来越多的时代,能够清晰表达自己思路与技术的人却少之又少。 因此,我们发起了这个【编程达人挑战赛】——帮助你将代码变成作品,将技术转化为真正的价值,同时激励更多的人坚持写作与分享。 注:活动细则介绍请看此贴:[https://bbs.csdn.net/topics/619791811](https://bbs.csdn.net/topics/619791811)。

330人参与 去参加
  • 最近
  • 文章
  • 专栏
  • 代码仓
  • 资源
  • 收藏
  • 关注/订阅/互动
更多
  • 最近

  • 文章

  • 专栏

  • 代码仓

  • 资源

  • 收藏

  • 关注/订阅/互动

  • 社区

  • 帖子

  • 问答

  • 课程

  • 视频

搜索 取消

(ICLR 2019)APPNP传播用 PageRank,不用神经网络!

论文阅读:https://arxiv.org/pdf/1810.05997本篇文章核心贡献可以用一句话来总结:把 GNN 的 message passing 解耦,先用 MLP 做预测,再用 Personalized PageRank (PPR) 把预测在图上扩散。传统 GNN = “学习 + 传播” 绑在一起,而APPNP = “学习(MLP)” 和 “传播(PPR)” 分开做。传统 GNN的邻居传播为: ,特征变换为:,神经网络学习权重为:,这就意味着学习和传播是捆绑在一起的,每加一个 GCN 层,就是
原创
博文更新于 2025.11.14 ·
966 阅读 ·
12 点赞 ·
0 评论 ·
6 收藏

【目标检测】小样本度量学习

小样本度量学习(Few-Shot Metric Learning)通常用于分类任务​(如图像分类),但它也可以与目标检测(Object Detection)结合,解决小样本目标检测(Few-Shot Object Detection, FSOD)​问题。目标检测需要同时完成目标定位(Localization)​和分类(Classification)​,而小样本场景下,某些类别的训练样本极少(如“考拉”只有5张标注图像)。这会导致以下问题:样本不足​,尾部类别(如稀有物体)标注数据稀缺;
原创
博文更新于 2025.07.29 ·
1287 阅读 ·
9 点赞 ·
0 评论 ·
12 收藏

【PyTorch】y = x.flatten(2).permute(0, 2, 1)

1. 注意力机制:在 Transformer 或自注意力模型中,输入需要是 `[B, N, C]` 的形状,其中 `N` 是序列长度(这里 `N = H*W`)。将张量的最后两个维度(H 和 W)展平为一个维度。输入形状为[B, C, H, W],输出形状为[B, C, H*W]。输入形状为[B, C, H*W],输出形状为[B, H*W, C]。2. 矩阵运算:将通道维度 `C` 放在最后,方便与权重矩阵进行矩阵乘法。3. 特征聚合:将空间维度展平后,可以对每个空间位置的特征进行独立处理。
原创
博文更新于 2025.03.19 ·
748 阅读 ·
6 点赞 ·
0 评论 ·
7 收藏

【深度学习】走向VQ-VAE模型

有监督任务(Supervised Tasks)的数据包含输入特征和对应的标签(目标值),模型学习从输入到输出的映射关系,典型任务有分类、回归、序列标注等。无监督任务(Unsupervised Tasks) 的数据仅包含输入特征,无标签,模型从数据中发现隐藏结构或模式, 典型任务有聚类、降维、特征学习、密度估计等。将数据分组为相似的子集(簇),比如客户分群,输入为用户行为数据,输出为高价值用户、普通用户等群组。具体算法有K-means、层次聚类、DBSCAN。减少数据维度,保留重要信息。
原创
博文更新于 2025.03.19 ·
1801 阅读 ·
33 点赞 ·
0 评论 ·
12 收藏

【PyTorch】.pt文件

是 PyTorch 中用于保存张量()或模型()的二进制文件格式。它使用 PyTorch 的序列化机制来保存数据,能够高效地存储和加载张量或模型的状态。
原创
博文更新于 2025.03.17 ·
1607 阅读 ·
5 点赞 ·
0 评论 ·
6 收藏

【强化学习】第二讲——探索与利用exploration vs. exploitation

利用(Exploitation) :基于当前已知的信息,选择能够带来最大收益的决策。优势:最大化当前收益。风险:可能错过更优的决策,陷入局部最优。探索(Exploration) :尝试新的或不确定的决策,以获取更多信息。优势:可能发现更优的决策,提升长期收益。风险:短期内可能无法获得最大收益。在多臂老虎机问题中,我们面对一台拥有 K 根拉杆的老虎机,每根拉杆都对应一个独立的奖励概率分布 R。每次拉动一根拉杆,我们都会从该拉杆对应的奖励分布中获得一个奖励。
原创
博文更新于 2025.03.16 ·
1472 阅读 ·
22 点赞 ·
0 评论 ·
27 收藏

【强化学习】第一讲——强化学习简介

强化学习指的是通过交互学习来实现目标的计算方法。机器和环境的一轮交互是指,机器在环境的一个状态下做一个动作决策,把这个动作作用到环境当中,这个环境发生相应的改变并且将相应的奖励反馈和下一轮状态传回机器。这种交互是迭代进行的,机器的目标是最大化在多轮交互过程中获得的累积奖励的期望。强化学习用智能体(agent)这个概念来表示做决策的机器。相比于有监督学习中的“模型”,强化学习中的“智能体”强调机器不但可以感知周围的环境信息,还可以通过做决策来直接改变这个环境,而不只是给出一些预测信号。
原创
博文更新于 2025.03.16 ·
1247 阅读 ·
19 点赞 ·
0 评论 ·
19 收藏

【强化学习】PPO算法代码详解

是一种用于强化学习的策略优化算法,由OpenAI在2017年提出。PPO结合了策略梯度方法的优点和信任区域优化(Trust Region Optimization)的思想,旨在实现高效、稳定的策略优化。它已成为强化学习中最常用的算法之一,广泛应用于各种任务,如游戏、机器人控制和自然语言处理等。PPO的核心目标是通过,确保每次更新后的策略不会与之前的策略偏离太远,从而避免训练过程中的不稳定性和崩溃。具体来说,PPO通过引入一个“剪裁”(clipping)机制,限制策略更新的幅度,使其在一个安全的范围内进行。
原创
博文更新于 2025.03.15 ·
1030 阅读 ·
5 点赞 ·
0 评论 ·
6 收藏

信道编码中的硬判决与软判决

硬判决 (Hard Decision)软判决 (Soft Decision)核心将模拟信号直接量化为二进制0/1保留信号的模拟量值或概率信息比喻黑白照片(只有两种颜色)灰度照片(包含明暗层次)
原创
博文更新于 2025.03.07 ·
628 阅读 ·
11 点赞 ·
0 评论 ·
5 收藏

【代码详解】信道编码——低密度奇偶校验码LDPC

data_tensor : 输入数据张量,形状为 [batch_size, data_length] ,表示批量二进制信息位d_v : 变量节点度数(每个变量节点连接的校验节点数)d_c : 校验节点度数(每个校验节点连接的变量节点数)malv : 码长扩展倍数( n = data_length * malv )snr : 信噪比(用于模拟信道噪声)每个变量节点(对应编码后的一个比特)连接的校验节点数量。对于规则LDPC码来说,所有变量节点的度数相同,均为 d_v;
原创
博文更新于 2025.03.07 ·
2655 阅读 ·
14 点赞 ·
0 评论 ·
29 收藏

Channel State Information 信道状态信息

是无线通信系统中的一个重要概念,指的是接收端或发送端对无线信道特性的估计和反馈。因此,了解当前信道的状态至关重要,这就是CSI的作用。:发送端根据CSI选择合适的调制方式(如QPSK、16-QAM、64-QAM)和编码速率,以最大化数据吞吐量。,表示当前时刻的精确信道状态,随着时间和用户位置的变化而不断更新。中,利用CSI进行波束赋形,提升信号质量并减少干扰。,描述了发送端与接收端之间的信道增益和相位变化。:通过CSI信息,系统可以优化干扰抑制技术,如。变化较慢,适用于长期优化策略,如。
原创
博文更新于 2025.03.01 ·
1257 阅读 ·
5 点赞 ·
0 评论 ·
12 收藏

【强化学习的数学原理】第三章 贝尔曼最优公式

state value可以用来评估一个策略的好坏,当时,方案1比方案2要好。所以我们就可以定义,当时,说明方案*比任何一个方案都好。那么最优策略是否存在呢?最优策略是否唯一呢?最优策略时随机的还是确定的呢?如何获取最优策略呢?为了回答这些问题,我们需要研究贝尔最优公式。贝尔曼最优公式有两种格式,
原创
博文更新于 2025.02.10 ·
1229 阅读 ·
28 点赞 ·
0 评论 ·
21 收藏

【强化学习的数学原理】第二章 贝尔曼公式

指的是某状态下选择不同action得到action value平均值:我们可以知道,已知:可得:第2课-贝尔曼公式(例子说明Return的重要性)_哔哩哔哩_bilibili第2课-贝尔曼公式(State value的定义)_哔哩哔哩_bilibili第2课-贝尔曼公式(贝尔曼公式的详细推导)_哔哩哔哩_bilibili第2课-贝尔曼公式(公式向量形式与求解)_哔哩哔哩_bilibili第2课-贝尔曼公式(Action value的定义)_哔哩哔哩_bilibili............1%7D。
原创
博文更新于 2025.02.10 ·
1279 阅读 ·
16 点赞 ·
0 评论 ·
21 收藏

【强化学习的数学原理】第一章 基本概念

是一个实数、标量,如果数为正数,则鼓励这种行为,如果数为负数,则惩罚这种行为。从某种意义上讲,正数也可以代表惩罚,负数也可以表示鼓励,这时候agent就希望要更小的reward。会伴随概念terminal state,当agent遵循一个policy与环境进行交互时,agent可能停止在某些terminal state上,而最终导致的trajectory称作episode,描述的就是agent相对于环境中的状态,在grid-world例子中,agent的位置就是状态,对于每个状态会有一系列的可采取的行动。
原创
博文更新于 2025.02.09 ·
935 阅读 ·
8 点赞 ·
0 评论 ·
13 收藏

【抽象代数】1.2. 半群与群

设为一个非空集合,上有二元运算,满足结合律,则称或为一个。
原创
博文更新于 2025.02.09 ·
1572 阅读 ·
7 点赞 ·
1 评论 ·
11 收藏

【抽象代数】1.1. 运算及关系

1.1. 运算与关系
原创
博文更新于 2025.02.08 ·
523 阅读 ·
4 点赞 ·
0 评论 ·
5 收藏

【数据集】图像字幕Image Captioning数据集下载——COCO caption

由Chen等人在中引入,COCO字幕包含超过150万个字幕,描述了超过330,000张图像。对于训练和验证图像,为每个图像提供了五个独立的人工生成的字幕。针对imagecaption任务,通常在论文中会使用COCO2014,train有82783张,val有40504张,test有40775张,每张图片对应有5~7句的caption。
原创
博文更新于 2025.01.20 ·
985 阅读 ·
11 点赞 ·
0 评论 ·
6 收藏

软件工程的课件,包含从第一周到第四周的课件内容

发布资源 2025.01.15 ·
rar

微波课程的课件,包含从第一周到第四周的课件内容

发布资源 2025.01.15 ·
rar

微处理器课程的课件,包含从第一周到第四周的课件内容

发布资源 2025.01.15 ·
rar
加载更多