Deep Sets 求和以后还剩什么:用两组反例检查集合表征 把一组无序观测交给模型时,打乱输入行序不应改变整组结论。Deep Sets常用“逐项变换、求和、再变换”的结构满足这个要求。不过,求和不看顺序,并不保证保留了所有信息。检查模型结构前,先用几组小输入问清楚:读者需要不... yunqueblog/ AI分享/ 2026-10-03/ 2 阅读
一段声音切得更细,置信度就该更高吗:检查 noisy-OR 汇聚 声音识别模型可能先给每个短片段打分,再判断整段录音中有没有某种事件。若把录音切得更密,片段级分数几乎没变,整段分数却大幅上升,应该先检查汇聚规则。noisy-OR给出了一个容易复算的例子:样本条数与独立信息量不能直接... yunqueblog/ AI分享/ 2026-10-03/ 2 阅读
线性注意力的乘法重排:少存一张大矩阵,分母和因果前缀仍要对齐 长序列注意力会涉及大量查询与键的配对计算。线性注意力的一条思路,是先把键和值汇总成较小状态,再让查询读取状态。阅读或实现这类模块时,应先固定相似度函数,核对两种计算顺序是否等价,再检查因果范围和归一化。 yunqueblog/ AI分享/ 2026-10-03/ 2 阅读
有符号特征哈希:同样发生碰撞,为什么加上负号能让内积无偏 文本分类或在线学习中,特征名可能不断增加。特征哈希把名称直接映射到固定数量的桶,避免维护不断扩大的词典,但不同特征会碰撞。有符号版本额外给每个特征一个固定的正负号。检查这种压缩方法时,最容易混淆的是“平均误差为零”和... yunqueblog/ AI分享/ 2026-10-03/ 2 阅读
随机傅里叶特征:内积算出负数,为什么仍可能是合法核近似 希望给线性分类器加入非线性表达,又不想保存全部样本对的核矩阵时,可以先计算随机傅里叶特征。每个样本被映射到一组固定长度的显式坐标,再用坐标内积近似目标核。真正需要验收的是近似误差及映射的一致性,而不只是程序能否输出一... yunqueblog/ AI分享/ 2026-10-03/ 1 阅读
Nyström核近似:两个地标选在同一方向,伪逆也补不回另一维 核模型需要比较许多样本对,完整相似度矩阵可能占用大量内存。Nyström方法只选少量样本作地标,再利用这些列近似全矩阵。实施时除了决定留几个地标,还要检查它们覆盖了哪些方向。下面的小例适合拿来验收AI生成的核近似代码... yunqueblog/ AI分享/ 2026-10-03/ 1 阅读
GitHub Copilot已弃用四款旧模型:替代名单明确,企业需检查模型策略与客户端 2026年10月2日,GitHub宣布四款模型在GitHub Copilot各项体验中弃用,范围包括Copilot Chat、行内编辑、ask与agent模式以及代码补全。公告使用的是已经生效的状态,依赖这些模型的团... yunqueblog/ 最新资讯/ 2026-10-03/ 1 阅读
Cloudflare OHTTP Gateway开启封闭测试:托管解密网关,仍需独立第三方中继 2026年10月2日,Cloudflare宣布自助式OHTTP Gateway开启封闭测试,并邀请开发者登记候补名单。产品计划作为zone的付费附加项提供;同一公告还把此前的Privacy Gateway更名为Clo... yunqueblog/ 最新资讯/ 2026-10-03/ 1 阅读
Cloudflare Traces进入公开测试:平台请求链路可追踪,采样与上下文信任要分开配置 2026年10月2日,Cloudflare宣布Traces进入公开测试,将自动追踪从Workers扩展到请求经过的其他平台环节。官方列举的可见内容包括受支持的安全规则、请求改写、缓存判断、路由、Worker执行和源站... yunqueblog/ 最新资讯/ 2026-10-03/ 1 阅读
Security Hub加入修复计划:共同根因集中处理,影响数字不能直接相加 2026年10月1日,AWS为Security Hub推出remediation plans。新功能把共享根因的暴露发现放进修复计划,让团队围绕底层资源处理问题。它覆盖Security Hub已提供服务的区域,并包含... yunqueblog/ 最新资讯/ 2026-10-03/ 1 阅读