法律状态: 全部 已授权 审中
项目申报: 全部 报过 没有报过
4 件在售专利
本发明公开了一种基于强扰动检测与模型再训练的深度强化学习交通信号控制中毒防御方法,该方法首先利用强扰动获取输入数据中的后门数据,再对后门数据进行识别进一步确定异常数据点,最后可通过数据层面的防御将测试过程中异常数据的异常数据点进行去除,或是通过模型层面的防御将原始训练数据与反向触发器重构训练集对中毒模型进行忘却学习使得中毒模型忘却触发器引发的异常行为。本发明通过检测方法首先将异常交通状态数据筛选出来,只需在后门数据子集中寻找“反向触发器”而无需对所有输入数据进行计算,最后通过两个层面的防御方法对模型层面和数据层面进行防御,以此消除后门触发器带来的异常行为,提高交叉路口的车辆通行效率。
📄 2022110410011 📂 H04L9_40 👤 浙江工业大学 📅 2022-08-29
¥0.0
基于双流信息瓶颈的深度强化学习行动者‑评价者网络结构及对四轮独立转向独立驱动车辆的路径跟踪控制方法,包括:在Critic网络中,在Q值估计之前加入已知信息瓶颈模块,从中提取已知类信息,并设计训练目标以最小化时间差分误差、最小化互信息、并约束参数范数;在Actor网络中,在策略生成模块之前加入未知信息瓶颈模块,从中提取未知类信息,并设计训练目标以最大化期望累积奖励、最大化互信息、最小化条件熵;在训练过程中,将样本中的状态和动作输入Critic网络和互信息估计器网络,得到Q值估计和互信息估计,并通过最小化目标函数更新Critic网络参数;通过策略梯度定理和重要性采样来更新Actor网络参数,以最大化目标函数;同时,独立训练互信息估计器网络,通过采样和优化实现对互信息的最大化估计;为了实现动态调节,设置权重调度器,根据当前训练轮数和平均回报,动态调整Actor和Critic目标函数中的系数,并使用线性衰减策略进行调节。
📄 2024114316041 📂 G05D1_43 👤 浙江工业大学 📅 2024-10-14
¥0.0
本发明公开了一种基于深度强化学习的卫星探索控制系统及方法,系统包括强化学习模块和环境模块,环境模块包括动作模块、初始化模块、状态更新模块、基础环境模块、奖励计算模块;强化学习模块调用初始化模块,初始化模块对基础环境进行初始化,完成初始化后由初始化模块返回当前状态,强化学习模块在获得当前状态后输出动作给环境模块;环境模块中的动作模块捕获动作进行处理,交由状态更新模块调用基础环境模块来处理当前环境状态更新,再由奖励计算模块获取所有状态和动作信息后给出当前这轮学习的奖励,并将奖励和更新后的状态传递给强化学习模块;强化学习模块结合当前所有的信息构成四元组并进行训练后,再根据下一步状态输出下一个动作。
📄 2023106541999 📂 B64G1_10 👤 浙江理工大学 📅 2023-06-05
¥0.0
本发明属于无人艇航迹控制领域,公开了一种基于深度强化学习的无人艇航迹控制方法。包括如下步骤:用于具有大迟滞性系统的无人艇航迹控制的深度强化学习框架,通过该深度强化学习框架使无人艇这类大迟滞性的非马尔科夫系统也可通过深度强化学习取得良好的训练效果。
📄 2020113530124 📂 G05D1_02 👤 江苏科技大学 📅 2020-11-26
¥0.0
发明 已授权

基于深度强化学习的卫星探索控制系统及方法

2023106541999 · 浙江理工大学
¥0.0
发明 已授权

一种基于深度强化学习的无人艇航迹控制方法

2020113530124 · 江苏科技大学
¥0.0

求购专区 · 发布技术需求,卖家在线应标

🔋 高能量密度固态电解质材料与制备工艺
预算:¥50-100万截止:2026-08-30发布方:××新能源科技响应:8人

交易保障 · 安心交易

资金托管

买家付款至平台,交易完成/过户成功后放款给卖家

权属尽调

专利有效性分析 + 权属状态核查,确保交易安全

合同审核

标准转让/许可合同模板,支持在线电子签署

全程代办

著录项目变更、备案手续全程代办,省心省力

交易流程 · 六步完成专利交易

1
选专利
2
在线沟通
3
签署合同
4
支付款项
5
办理变更
6
过户完成

成功交易案例

🔬

固态锂电池电解质专利包

转让方:中国科学院××研究所
受让方:××新能源科技有限公司
交易类型:独占许可
交易金额:¥320万
🧬

CRISPR基因编辑技术

转让方:××大学
受让方:××生物医药有限公司
交易类型:转让
交易金额:¥1,200万

SiC功率器件工艺专利

转让方:××半导体有限公司
受让方:××汽车电子集团
交易类型:转让
交易金额:¥680万
☀️

钙钛矿光伏组件技术

转让方:××科技公司
受让方:××能源集团
交易类型:开放许可
交易金额:¥50万/年