让 AI 检查蓄水池抽样:只留两条记录,先到的数据为何仍有公平机会 持续到来的模型评测记录或训练回放候选,可能多到无法全部留存。如果希望保留全历史的均匀小样本,只保存最近几条会偏向后来的数据,最先装满后不再更新又会偏向早期数据。蓄水池抽样用固定容量,在尚不知道最终长度时维持明确的抽样... yunqueblog/ AI分享/ 2026-10-03/ 2 阅读
用 AI 平衡 Sinkhorn 传输:每行都归一了,为什么两列仍然分得不对 在特征匹配或分布比较中,一行权重常表示某个来源分给各目标的质量。逐行softmax能保证每个来源分完自己的份额,却不保证目标收到的总量合适。最优传输同时约束两端,Sinkhorn迭代通过交替缩放行与列来满足这两套配额... yunqueblog/ AI分享/ 2026-10-03/ 2 阅读
让 AI 追踪梯度反转层:前向值没变,为什么两部分参数朝相反目标更新 模型从一种拍摄环境迁到另一种环境时,希望特征仍能完成任务,同时少依赖环境身份。领域对抗训练加入一个预测域来源的分支:域预测头努力分清来源,特征提取器则接受相反方向的域信号。梯度反转层把这两个目标接在一起,却不改变前向... yunqueblog/ AI分享/ 2026-10-03/ 2 阅读
llama.cpp接入System One决策API:五类模型可本地评分,图像、语言与许可范围各不相同 2026年10月2日,ggml-org发布技术文章,介绍llama.cpp服务器新增的/v1/systemone决策模型接口;对应PR29818已在当天合并到主分支。文章元数据时间为14:22 UTC,即北京时间22... yunqueblog/ 最新资讯/ 2026-10-03/ 2 阅读
Lakebase LTAP Direct Writes正式可用:首批装载直写存储,已有同步表不能直接加开关 Databricks在2026年10月1日的Lakebase发布说明中宣布,LTAP Direct Writes已正式可用,支持运行Postgres 16、17或18的Lakebase项目。功能用于加速同步表的初始装... yunqueblog/ 最新资讯/ 2026-10-03/ 2 阅读
Databricks宣布IP函数正式可用:地址与网段可直接关联,最低运行时标注仍需逐项核对 2026年10月1日,Databricks宣布原生IP函数正式可用,让SQL、PySpark和Scala工作流直接处理IPv4、IPv6地址及CIDR网段。官方博文元数据标注01:46 UTC,即北京时间09:46。... yunqueblog/ 最新资讯/ 2026-10-03/ 2 阅读
让 AI 推演孤立森林:切点均匀随机,为什么远处样本更容易先被分开 无监督异常检测中,孤立森林通过随机切分来观察样本有多容易被单独分开。所谓随机,并不意味着每个样本第一次就被隔离的机会相同。若某点与其他点之间空隙很大,切点落进这片空隙的机会也更大。四个点就足以量出这种差异。 yunqueblog/ AI分享/ 2026-10-03/ 2 阅读
用 AI 算分位数回归:预测八和预测十,为什么都能拿到最低损失 给服务耗时做预测时,低估与高估的影响可能不同。分位数回归通过不对称损失表达这种取舍。可把问题缩小成“所有记录都报同一个数”:即便数据固定,最小损失也未必只有一个预测值。让AI交出整段斜率,比只交一个百分位数更有解释力... yunqueblog/ AI分享/ 2026-10-03/ 2 阅读
让 AI 算 Mixup:标签可以按比例混合,两个原样本的损失为何不能直接平均 Mixup把两条训练输入按比例合成,同时混合它们的标签。实现时有时只看见“两份损失加权”,便误以为原样本各算一次再平均就够了。关键要问:两份损失是不是基于同一个混合输入的预测?用一个非线性小函数可以把区别算清楚。 yunqueblog/ AI分享/ 2026-10-03/ 2 阅读
用 AI 核对知识蒸馏:损失乘了温度平方,梯度为何仍没完全变回去 把较大的分类模型压缩到小模型时,知识蒸馏会让学生学习教师给出的整组概率。相关实现常把软目标损失乘T²。若AI把这解释成“温度影响被精确抵消”,一个三分类算例就能发现不对:补偿后的梯度仍可能变化。 yunqueblog/ AI分享/ 2026-10-03/ 2 阅读