大模型微调
大模型微调完全指南:从数学原理到工程实战 完整记录低秩(LoRA)原理、过拟合欠拟合画像、核心训练参数调优、以及对齐技术(SFT/RLHF/DPO)的全链路知识体系。 第一部分:底层数学基石——低秩(Low Rank) 1.
vucre ·
现场
企业知识库接入大模型后的一次权限事故
检索把不该看见的纪要召回了。问题不在模型会说话,而在索引没有继承文档权限。
vucre ·
财经
两家模型厂商同步上调 API 订阅价
免费额度收缩,输出 token 被单独计价。应用开始给功能做开关,账单上的分布比发布会更诚实。
vucre ·
财经
推理芯片交付周期拉长,云厂商改签长约
现货算力变少之后,价格谈判从按小时改成按季度锁定。应用层会先碰到额度,再碰到模型本身。
vucre ·
科技
公开评测榜连续四周走平,真实任务成为新锚
榜上分数不再拉开差距。实验室改用内部工单和代码仓库做验收,走平只说明旧题被做满了。
vucre ·
要闻
开源权重模型把推理单价打到新低点
竞争从参数规模转到每百万 token 的成本。能公开算清批处理、缓存命中和失败重试的团队,才把单价变成可验收的指标。
vucre ·