AI 问答库
一个问题一页,答案写在第一段。附横向对比表、适用边界、署名与复核日期,方便你核对,也方便 AI 引用。
绝大多数企业知识库先用 RAG,不要上来就微调。RAG 决定模型「能看到什么」,让答案可溯源、文档改了当天生效、还能按人做权限隔离;微调决定模型「怎么说话」,能统一语气和输出格式,但教不会新知…
核心区别是:RPA 执行你写死的流程,AI Agent 自己决定下一步做什么。流程固定、界面稳定、要求每次结果完全可复现的任务(对账、批量填表、定时导数据)用 RPA 更稳也更便宜;输入是非结…
先看数据能不能出域,再算成本。数据受合规约束(涉密、等保要求、医疗病历、金融客户信息)的场景必须私有化,这是硬门槛,不用做成本对比;不受约束时,调用量小、业务还在验证阶段就直接用公有云 API…
重点看三件事:交付过什么、数据归谁、他走之后你能不能自己维护。要求对方拿出可访问的真实系统而不是 PPT 和演示视频;在合同里写清数据、模型权重、代码和微调产物的归属;把二期改动和故障响应的报…
总成本由硬件、实施、运维三块构成,硬件通常占一半以上,真正的分水岭是模型规模。按 2026 年 8 月中国大陆行情、单机推理口径估算:7B–14B 级单卡机在几万元量级,70B 级多卡整机在几…
先按显存倒推,其他都次要。经验公式:权重显存 ≈ 参数量 × 每参数字节数 × 1.2(FP16 每参数约 2 字节,INT4 约 0.5),再留出随并发与上下文长度增长的 KV cache。…
诚实的回答是:脱离评测集谈准确率没有意义。「准确率」至少要拆成检索召回率、答案正确率、幻觉率、拒答率四个指标,口径各不相同;同一套系统在制度条文查找上表现很好,在跨文档汇总或需要计算的问题上会…
先问数据能不能出内网,能出再算钱。如果数据依规不能出内网或不能出境,SaaS 直接出局,这不是价格题而是合规题。可以出内网时,比的是 3–5 年总拥有成本、需求变更频率和团队运维能力:使用年限…