随梦书屋 通过搜索各大小说站为您自动抓取各类小说的最快更新供您阅读!

第311章 燧火机器学习开发框架

燧火之名,源自燧人氏取火的古老神话传说,那是人类首次掌控的可控能源。

如今,历景铄希望它能成为机械智能的起源,开启一个全新的时代。

燧火框架主要涵盖了数据处理、模型构建、模型训练、模型评估这四大核心功能模块。

先说数据处理部分,数据加载环节至关重要,它具备从本地文件、网络文件系统和数据库等数据源读取数据的能力。当然,前世常见的各种大数据文件系统或者对象存储文件系统现在连影都没有,这个框架自然也不会有对应的加载处理能力。

数据从数据源里面读取进来之后,会被转化成与数据类型相适配的对应内存数据结构。

在秦奕的建议下,燧火里定义了一个和前世流行机器学习框架 pYtoRch 中的张量类似的基本数据类型来存储各种各样的数据,该数据类型是基于乾坤语言原生多维数组的一种对象,能够很方便的表示零维标量、一维向量、二维矩阵甚至更高维的数据。

历景铄做得是计算机视觉算法研究,最常用的便是表达一张图片的三维数组,三维分别是长、宽、颜色通道,颜色通道数值可以是 RGb 这种数字图像和视频处理的标准颜色表示方式也可以是 cmY 这种印刷行业标准的颜色模型,框架里提供了两种模型互相换算的能力。

在将数据读取进内存之后,用户就需要对现有的数据做预处理了,燧火框架提供了一系列数据清洗、归一化、标准化等预处理操作。

在数据清洗方面,框架提供了多种便捷的清洗能力。

面对文本数据中可能出现的乱码,框架会通过字符编码识别与转换算法,将其纠正为正确的字符格式。

若是数据中存在重复记录,比如数据库中可能因录入失误产生的完全相同的行,燧火框架会利用哈希算法对每条记录进行快速计算,对比哈希值来精准识别并删除重复数据。

对于缺失值,若是数值型数据,框架会依据数据的分布情况,采用均值、中位数或者众数填充法。

比如对于一组学生成绩数据,若某个学生的数学成绩缺失,会先计算其他学生数学成绩的均值,再用该均值填充缺失值;若是类别型数据,如学生的籍贯信息缺失,就会采用出现频率最高的籍贯类别进行填充。

在归一化操作上,燧火框架主要运用了两种常用方法。一种是最大 - 最小归一化,它将数据的取值范围映射到从零到一的双闭区间,另一种是 Z - score 归一化,它基于数据的均值和标准差进行转换,将数据转换为均值为 0,标准差为 1 的分布。

通过这样的归一化处理,不同特征的数据在数值范围上保持一致,避免因特征数值范围差异过大,导致模型训练时某些特征被过度重视或忽视。

标准化操作在燧火框架中也有便捷的实现方式,框架会对数据进行零均值化处理,即先计算数据的均值,然后将每个数据点减去均值,使得处理后的数据均值为 0,接着计算数据的方差,再将每个数据点除以方差的平方根,从而得到方差为 1 的数据分布。

历景铄在设计燧火框架时,精心打磨了这些功能,如此一来,用户便能利用燧火框架进行细致的清洗、归一化和标准化,让数据以最佳状态进入下一阶段。

在后面的模型构建、训练、评估三大功能模块,秦奕同样大幅度借鉴 pYtoRch 的设计来指导历景铄团队燧火框架的设计。

如此一来,在模型构建环节,用户可以轻松定义各种机器学习模型,不管是简单的线性模型,还是复杂的决策树、神经网络等都不在话下。

在训练方面框架也直接内置了经典的随机梯度下降算法等优化算法,用户只要写一行代码便可以以此来训练模型,不断调整模型的参数,以最小化损失函数。

这里不得不提到反向传播算法,它是模型训练中极为关键的一环,在神经网络中,正向传播负责将输入数据通过各个神经元层层传递,最终得到预测结果。

而反向传播则是在计算出预测结果与真实标签之间的误差后,从输出层开始,沿着与正向传播相反的方向,将误差信号依次向后传播。

在这个过程中,利用链式法则计算每个参数的梯度,梯度代表了参数在哪个方向上变化能最大程度减少误差。

例如,对于一个简单的包含输入层、隐藏层和输出层的神经网络,正向传播时输入数据经过隐藏层的权重矩阵和激活函数计算后得到输出,与真实标签对比得到误差。

反向传播时,从输出层的误差开始,根据激活函数的导数以及权重矩阵,逐步计算出隐藏层权重的梯度,进而更新权重,使得模型在下次预测时能更接近真实值。

最后在模型评估环节,燧火框架的评估指标计算功能能够精准计算各种评估指标,像准确率、召回率、均方误差等,这些指标能直观地反映模型的性能。

除了这几个核心功能之外,燧火框架还有一个十分实用的辅助功能 —— 可视化。

它能将模型训练的结果、数据的分布等以可视化的方式呈现出来,帮助用户更好地理解模型和数据,历景铄团队目前是基于乾坤语言的乾元绘卷图形接口库整合了一些绘制数据的散点图、模型的训练曲线等比较简单的图表绘制功能。

后续他们还会基于机器学习方面功能进一步开发出各种直观的可视化图表,从数据的初始分布,到模型训练过程中的变化,再到最终的评估结果,都能以清晰的图表形式展现,让复杂的数据和模型不再晦涩难懂。

有了这么一个趁手的开发框架,历景铄的人工智能项目在这一年来也已经取得了初步的进展。

随梦书屋推荐阅读:知青重生:回到1978做生意我的天赋是渣滓?那快来杀!穿越长姐持家轮回数世的我,似乎是在被人倒追珠光宝器高手下山:我不当赘婿我的绝色总裁未婚妻(神级龙卫)我老婆是冰山女总裁璀璨星途龙皇武神说好考古,你这漫画都成真了?陈黄皮叶红鱼全文免费阅读正版沈浪万界科技系统[红楼+倩女幽魂]目标!探花郎重生之农女当自强我的绝色总裁未婚妻(又名:神级龙卫)这只皇帝会读心重生之芬芳人生红楼之魔门妖女都市之罗小黑传奇重生八零,团宠娇娇医手遮天目标!探花郎神级护卫麻衣神婿陈黄皮叶红鱼重生之后妈很抢手我一生行善,竟觉醒万魂幡!沈浪与苏若雪最新章节更新我卖廉价药救人,你们告我上法庭我全能艺人,会的多点不过分吧!神级龙卫沈浪最新更新护花狂尸来自山村的铁血王子神级龙卫完美人生沈浪全文免费阅读机娘纪元:我的机娘都是世界级基因无限进化神豪从刮刮乐开始我为高武第一剑仙,何人敢战流氓小村医一拳琦玉的生发之旅郁先生的小娇妻又翻天了女镇长的贴身兵王道主有点咸沈青瑚薯片菇凉拽上天冰冻寰宇农家团宠六岁半和离前夜,她重生回了出嫁前火红年代,我带空间去下乡开局无限强化,英雄兵种全神级
随梦书屋搜藏榜:带着包子去捉鬼从陵墓中苏醒的强者大小姐偷偷给我生个娃独宠名门前妻女配升级攻略:医蛊王妃农家丑妻宋不凡的超级系统怕什么,我有无敌空间洛少霸道:娇妻哪里逃被渣后她嫁给了九千岁兵之王者契约农妃的马甲又被扒了什么流量艺人,我是实力派山村野花开神说你要对女人负责极品龙婿终极一班:重生成雷克斯重生之丁二狗的别样生活异界之学徒巫妖和步行骑士过气歌手出走半生,归来仍是巨星万古长空一朝风月重生之人渣反派自救系统高山果园炼狱孤行者转生成兽娘被神收编了陌上花开我要当影后保护校花半世浮生半世殇重生八零我每天靠败家躺赢敢霸凌我妹妹:那就杀个痛快!闹婚之宠妻如命极品警察穿越之黎明的秦重生之低调富翁他似春火燎原娱乐:表白失败后,拒绝当舔狗!小青梅她有点难追转职人皇,技能变态点很合理吧穿成癌症老头,还好我有遗愿清单前妻好可口:首席,别闹男神娇宠之医妻通灵民国,我在淞沪打造特战旅弃妃无双[综+剑三]明眸善媚都市妖孽狂兵灵启都市纪元:佣兵的平凡幻变灵气复苏:我走向无敌路他今夜又来撒野了这只皇帝会读心穿书后我渣了偏执大佬
随梦书屋最新小说:我的人生无限抉择大院人家针破苍穹抛夫弃子求真爱,被白月光渣了你找我?被女知青抛弃后,我靠打猎走上人生巅峰重生1931,我有一座军事仓库玄天神医重生77,从拒绝村花开始逆转人生1961饥荒:从打猎开始,带领全家致富!清纯校花一实习,就被我追到手了复明后,傲娇总裁在我怀里哭唧唧未来世界AI统治人类离婚后,我的绝世战神大老婆后悔了魔族圣女和他的极品师傅玲珑塔下的爱情我为穿越者跑腿,惊动了国家爸爸我就养个电子宠物,你跟我说是九尾天狐?谁说当舔狗蠢啊,当舔狗可太棒了!灵烛师神医:开局同居丰满女护士娱乐:摆烂的我要发力了!舞侠2开局分家,真少爷一家悔哭了鉴昭行浴火重生:凤逆天下一人:我都硬刚天师了,系统才来权途:从乡镇科员开始重回85,开局和吸血鬼家庭断亲惊山月全职法师:开局八奇技,下山无敌重回1985之长姐风华昭娇修仙吗,舒心就好重生之无敌帝尊重回2001加点升级公司全是女网红,这谁顶得住啊!一不小心穿越成了老天爷重生80,断绝关系后我垄断了南方市场带上五岁妹妹走天下官途:从偶遇美女县长开始你都手撕鬼王了,还说不会武功?你家小教授也呆呆的?路边要奶喝的我,被杀手姐姐养大抗战:旅长,冤枉啊我真不是军阀四合院:我是有空间的保安重生78,开局赤手干掉一头熊大唐傀儡医带着房子穿女尊卖妻求荣?踹渣男嫁新帝荣宠后宫穿成花瓶美人,反派老公破产了