一种面向人工智能大模型高效训练的并行策略搜索方法

AITNT
正文
推荐专利
一种面向人工智能大模型高效训练的并行策略搜索方法
申请号:CN202411442290
申请日期:2024-10-16
公开号:CN118966321A
公开日期:2024-11-15
类型:发明专利
摘要
本发明公开了一种面向人工智能大模型高效训练的并行策略搜索方法,涉及人工智能技术领域,具体包括以下步骤:S1、输入人工智能大模型;S2、利用TensorFlow框架可视化人工智能大模型,生成大模型的计算图g,获取集群设备的拓扑图D;该面向人工智能大模型高效训练的并行策略搜索方法,通过挖掘神经网络模型并行训练过程中的计算和通信特点,建立分布式训练性能评估模型,更准确地评估并行策略的综合性能,通过采用双层策略网络构建智能体,减少搜索过程中的开销,防止内存溢出,通过采用随机梯度上升算法有利于算法在参数改变可能导致新旧策略概率分布的剧烈变化时保持平稳收敛。
技术关键词
并行策略 搜索方法 TensorFlow框架 分布式训练 拓扑图 内存 集群 模拟器 浮点操作数 算法 参数 衡量设备 人工智能技术 神经网络模型 顶点 规模 综合性 样本
系统为您推荐了相关专利信息
1
陆战对抗场景的异构智能体训练方法、系统及存储介质
注意力机制 策略 分布式训练 网络 异构
2
一种基于信息相关性的随机接入网络信息时效性优化方法
接入网络 时效性 年龄 矩阵 无线通信场景
3
适用于异形管母绝缘层绕制的复合机器人循迹方法及系统
复合机器人 执行器 循迹方法 移动底盘 轴心
4
一种基于优化数据存储分配的信息服务方法及系统
信息服务方法 多层神经网络模型 信息服务系统 梯度下降算法 数据存储系统
5
电磁信号图文的数据搜索方法、装置、设备、介质及产品
语义特征 图文 文本 电磁 数据搜索方法
添加客服微信openai178,进AITNT官方交流群
驱动智慧未来:提供一站式AI转型解决方案
沪ICP备2023015588号