[Machine Learning][Andrew ng's lesson] 标准表达式 Normal Equation

限时加码!20+主流AI编程工具免费用 购周边加赠Coding Plan Lite,Claude Code、Cursor等即刻畅享,学习进阶更高效! 阅读详情

Normal Equation :

According to Features Matrix X and the Result Matrix y

and the H(x) turns out to be

i=0nXiθi(Xo=1)

From pinv(X’*X)*X’*y to get the Correct θ Matrix.
Theory: To set the partial derivative(θj to J(θ)) equal to 0.

(In the same time ,it is not necessary to use Feature Scaling)

    h = 0 + 5*X1 + 7*X2 
    X = [1 2 4; 1 8 6; 1 3 7]
    y = [38;82;64]
    pinv(X' * X) * X' * y : 
    ans =
        -1.2221e-012
        5.0000e+000
        7.0000e+000

Disadvantage:
Need to compute pinv(X’X) O(n*n*n)
Slow if n is very large
Notice:
Even the X’*X can’t be inversed. Using pinv() instead of using inv() will compute the answers correctly.

Expand

It’s obviously less possible that a matrix can’t be inversed, but it can happen.
The Reasons are probably below:
1. Some features are same or have linear connection. For example, mile and feet are same, so we may know θx + 3.33θy = AExactNumber, but we can’t decide the θx and θy’s value, because there are too many possibilities.
2. The number of data (m) is less than the number of features. For example, we have 10 datas and 100 features. However ,we have a technique to solve this problem, which can be used to get h(x) which is made up of many variables from small datas.

Technique Explanation:

This technique will also solve the problem of overfitting by plusing a penality to the size of θ in J(θ).
(NOTICE! We only penalize θ from 1 to n, we don’t penalize θ0)
So the J may like this
这里写图片描述
And the normal equation will change to

newM = eye(n + 1);
newM(1,1) = 0;
pinv(X'*X + λ*newM)*X'*y

It can be proved that the Matrix which is to plus a new Matrix(λ >0) must has inverse Matrix.
So, we can get correct θ from small datas now!(λ>0)

聚类在 RAG 里的落地细节 RAG 主检索一般还是向量相似度(ANN),聚类解决「向量分布混乱、上下文割裂、检索冗余、长文档分片语义漂移」问题。常见聚类算法:K-Means、DBSCAN、HDBSCAN、层次聚类;RAG 场景,K-Means 适合已知类数的场景。 阅读详情

相关推荐

K-Means 聚类的目标函数:簇内误差平方和

K-Means 是一种无监督迭代式的聚类算法:给定数据集与预设簇数K,算法把样本划分为K个不相交的簇,使得同一簇内样本尽可能相似,不同簇间样本尽可能远离。核心思想:> “让簇内‘抱团’,让簇间‘疏远’。

Frost_Descent的博客 5068

数学建模国赛倒计时 1 天 ——《机器学习精讲(决策树理论篇)》

决策树 = 一张流程图 + 一套规则。解释给评委听,用决策树;追求精度,用随机森林。两者不冲突,可以先用决策树解释变量关系,再用随机森林提高精度。

统计学小王子的博客 197

AI-XGBoost机器学习与生态—植被与土地利用识别、土壤碳氮空间预测、生物多样性驱动机制、土壤微生物功能预测、生态退化与风险识

在众多机器学习方法中,XGBoost以其卓越的预测精度、对非线性和交互作用的天然刻画能力、对中小样本数据的良好适应性,以及SHAP等配套解释框架带来的机制解析能力,已成为生态、地学、环境、农业等领域高水平论文中应用最广泛的算法之一。课程不做概念宣讲,而是以真实研究流程为主线——从研究问题界定、多源数据整合、模型构建与调优、结果解释,到论文图表与文字表达——通过五类高频生态地学案例的完整实操,帮助学员把机器学习真正用进自己的课题中,形成可复现、可解释、可发表的研究成果。

weixin_xiao5kou4chang6kai4的博客 102

AI机器学习与深度学习学习资源合集

大家好,今天想和大家分享一下关于AI机器学习与深度学习的学习心得。很多人觉得AI的学习曲线很陡峭,但其实只要掌握了核心概念,入门并没有想象中那么难。从最初的图灵测试到现代的深度学习,AI经历了三次重大浪潮。第二次浪潮引入机器学习,让机器从数据中学习;第三次浪潮则通过深度学习实现了真正的突破,让机器能够自动提取特征并完成复杂任务。机器学习是AI的核心,主要分为三种范式: 1. 监督学习:需要标注数据,擅长分类和回归任务,如图像识别和房价预测。2. 无监督学习:无需标注,擅长发现数据中的隐藏模式。

a777511471的博客 97

机器学习1导学:算法分类、建模流程、特征工程、模型拟合

找西瓜,

2401_87118211的博客 49

机器学习在信贷风控建模中的优势和挑战

目前该方法应用于页面埋点动作的特征提取,将点击和浏览动作看作词,用户完整周期内的所有动作行为组成了段落和文章,再使用 word2vec 方法,将用户的点击浏览行为隐含表征为一定维度的向量,再将向量作为用户的特征输入 xgboost 进行建模,单个特征有 1-2 个 ks 点的提升,效果还是不错的。2)数万维的特征,数十万参数的模型。互联网金融中资质较差的客群基本没有资质数据以及合规的信贷数据, 虽然有一定的消费数据但是该类数据大多掌握在巨头电商平台手中,所以所能获取到的就是开放度高的互联网行为类数据。

qq_42865713的博客 220

机器学习】数据集不是素材库:样本、标签与分布决定了学习上限

本文以单关节机械臂的负载估计和温升预测为例,说明数据集不是存放日志的素材库,而是对模型任务边界的提前定义。文章从样本、标签与数据分布三方面展开:样本必须保留决策时可获得的时序上下文;标签必须准确表达目标,并通过时间同步、故障状态和规则校验;数据分布则应覆盖负载、温度、速度、方向与异常等真实工况,不能被重复的常态记录掩盖。文中进一步讨论时间泄漏、类别失衡、训练测试划分和数据契约,并给出从问题定义、质量筛选到影子运行的准备流程。核心结论是,模型能力上限往往早在训练前,已由数据的可信度与覆盖范围决定。

2402_86234774的博客 274

机器学习笔记】

信息存在于数据的相对大小中的数据同时加上/减上/乘上/除去一个常量,信息不变数据预处理,没有改变信息本身,但是对后面模型的训练/收敛有帮助以0为中心,以1为标准差的数据。

2301_76821799的博客 209

Manus+Haply组合方案落地:为机器人机器学习提供高质量人类演示数据

近期ABB Robotics与PSYONIC的合作实践,已经验证了“人类真实操作数据驱动机器人能力进化”的技术路径价值,而Manus数据手套与Haply力反馈设备组成的采集链路,正在为全球机器人研发团队提供一套完整、高保真的人类演示数据解决方案。随着全球机器人团队持续研发更适配复杂非结构化场景的操作系统,Manus+Haply组成的这套采集方案,将持续为行业输出一致、高保真的人类演示数据,成为训练机器人完成真实工业任务的核心基础设施,推动人形机器人从实验室演示走向大规模工业落地。

2301_81438894的博客 204

【优化方法】最小二乘:从误差平方到线性与非线性拟合

二乘:把误差的二次方作为代价;最小:寻找让这些二次误差之和最小的参数。一般地,给定观测值yiy_iyi​、模型预测值yifxi;θ和参数θ\thetaθ,定义残差riθyi−fxi;θ最小二乘问题写作θarg⁡min⁡θ∑i1nriθ2θargθmin​i1∑n​ri​。

weixin_48846514的博客 172

【有源码】基于机器学习的商场商铺运营分群与可视化分析研究 基于Spark的商场商铺经营效率分析与可视化

该系统从数据上传、预处理到多维分析与可视化结果输出的一站式能力:系统可读取商场商铺数据集并上传至 HDFS,完成字段类型转换与清洗后,基于 Spark 进行城市分布、业态占比、商圈分布、楼层分布、品牌 Top10、商场等级与城市租金、品类与等级客流、品类与城市销售、销售/客流、销售/面积、销售/员工、运营年限等统计分析,并结合 KMeans 聚类、Apriori/FPGrowth 关联规则、综合竞争力排名和运营异常检测挖掘商铺经营特征,最终将各类分析结果输出为结构化 CSV 文件,为后续图表可视化、运营决策

qq_2105837402的博客 202

机器学习】从机理建模到数据学习:机器学习究竟替代了什么

本文以单关节机械臂为例,说明机器学习并不是把控制理论、物理规律和安全约束全部换成黑箱,而是在摩擦、负载、温漂、间隙等因素使精确机理模型难以完整描述时,用历史数据学习输入与输出之间的映射或模型残差。文章分析失配来源、数据任务、时序样本的时间关系与故障标签,以及训练集和线上工况不一致带来的分布偏移。最后给出“机理模型打底、数据模型补偿、安全边界兜底”的混合方案,并提出离线评估、影子运行、受限接入和持续监控的落地路径。机器学习替代的不是工程责任,而仅是部分难以手工写出的经验映射;当数据失去可信性或超出覆盖范围时,

2402_86234774的博客 543

机器学习谈起

本文以通俗易懂的方式介绍机器学习,通过“等人”故事引出其核心思想——基于数据归纳规律。文章系统阐述了机器学习的定义、方法(如回归、神经网络、SVM)、应用(如语音识别、图像处理)及与大数据、深度学习、人工智能的关系。强调机器学习是模拟人类经验归纳的过程,具有广泛前景,尤其在自动驾驶、推荐系统等领域表现突出。作者呼吁将高深技术落地于实际场景,推动技术普惠。

sheep404的博客 212

Cisco Splunk for AI Operations:AIOps机器学习

AIOps定义:基于机器学习的智能运维,核心是将传统被动式IT运维转变为主动式洞察("The Intelligent Engine: Transforming Reactive IT with Machine Learning")。核心价值:解决传统IT运维的"数据噪音淹没信号"问题,通过ML技术从海量告警和日志中提取关键信息,实现故障的自动检测、关联分析与根因定位。典型场景:IT团队面临告警风暴("I'm drowning in noise!

pt1043的博客 120

AI大模型与数学 第75课 基、维度、向量空间坐标

这三个概念,是线性代数的「终极落地工具」,也是AI词向量、特征空间、模型降维、OPT空间梯度理论的底层地基。3. 多余特征大概率线性相关,造成维度冗余、空间信息重叠,模型拟合噪声,引发过拟合、计算冗余。同样是二维平面,为什么有的10个向量撑不起新维度,有的2个向量就能铺满整个空间?这两个向量斜着交叉,线性无关,也能组合出平面所有点,也是一组合格的二维基。除了横竖标准基,任意两个不共线、不重合的向量,都是二维空间的合法基。特征矩阵维度混乱、基向量冗余,无效维度太多,模型记住噪声而非真实规律。

2601_96546232的博客 专注数学与电子科学及工程技术分享交流。 428

人工智能、机器学习、深度学习、神经网络区别

人工智能、机器学习、深度学习、神经网络区别

姜穆澜的博客 480

J Headache Pain:前庭性偏头痛中的皮层形态变化:来自基于表面的形态学测量和机器学习的见解

前庭性偏头痛是一种常见的神经系统疾病,以头痛和反复发作的眩晕为特征,并伴有恶心、呕吐和平衡障碍。它影响普通人群的1%-3%,是发作性眩晕的主要原因,也是第二常见的前庭综合征病因。尽管前庭性偏头痛对生活质量有显著影响,并给个人和社会带来沉重的经济负担,但它常常被漏诊,其潜在的病理生理学仍知之甚少。因此,探究前庭性偏头痛背后的神经机制并识别可靠的生物标志物,是提高受影响个体诊断准确性和治疗结局的关键步骤。

NHKJ_ZF的博客 130

机器学习】损失函数与梯度下降:机器如何通过“犯错”不断变好

本文以单关节机械臂的负载估计为例,解释模型如何把“预测错了”转化为可执行的学习信号。损失函数负责度量预测与真实结果之间的差距,同时把任务目标、误差偏好与安全边界写进训练过程;梯度则描述每个参数朝哪个方向微调,最能让损失下降。文章借助“在损失地形中下山”的直觉,说明前向计算、损失评估、反向传播与参数更新构成的训练闭环,并讨论学习率过小、过大和合适时的差别。最后结合控制系统的反馈思想,区分训练误差与真实泛化能力,提醒读者:损失下降并不自动代表模型理解了世界,数据质量、任务定义和测试边界仍决定模型能否可靠部署。

2402_86234774的博客 94

数学建模国赛倒计时 1 天 ——《机器学习精讲(随机森林理论篇)》

随机森林 = 多棵树的民主投票。精度高、不解释、能告诉你谁最重要。国赛场景:解释用单棵树,精度用随机森林,两者完美互补。明天上考场,如果遇到以下问题,直接上随机森林:“有 30 个变量,不知道哪些重要?——随机森林给你排好序。“数据有噪声,单棵树不稳定?——随机森林帮你稳。“要预测精度高,解释性不强求?——随机森林最合适。

统计学小王子的博客 78
上一篇: [转载][Python]selenium之 chromedriver与chrome版本映射表(更新至v2.29)
下一篇: [Machine Learning] [Octave]Gradient Descent Practice
jkwRay
博客等级 码龄10年 0粉丝 7原创
评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值