来自实战 第 №108

观点,不是新闻稿

数据无关的向量量化把稠密的 float32 embedding 场压缩成紧凑的 2-bit 桶格,内存缩小 16 倍 AI 与智能体

把 RAG 向量内存压到 1/16:数据无关量化能上生产了吗?

一个新的 Rust 索引用 Google 免训练的 TurboQuant 把 1000 万 embedding 从 31 GB 压到 4 GB。方法证明了什么、在哪胜过 FAISS、recall 的取舍,以及如何试点。

欧盟 AI Act 第50条透明度义务映射为面向 SaaS 聊天机器人、AI 智能体与生成内容的落地清单 商业与监管

面向 SaaS 与 AI 智能体的欧盟 AI Act 第50条落地清单

第50条自2026年8月2日起适用。这份工程落地清单涵盖:聊天机器人与智能体告知、C2PA 机器可读标记、深度伪造标签、公共利益文本、日志,以及审计时需要拿得出的证据。

同一台服务器上八个各自隔离的按 rank 划分的 KV 缓存,坍缩成一个所有服务进程都能读取的共享主机侧缓存层 AI 与智能体

共享 KV 缓存在不新增 GPU 的情况下把 LLM 推理延迟降低 14x

一个开源 KV 缓存层在一个 235B 模型上把平均 time-to-first-token 从 3.98s 降到 0.29s。同样的 GPU,同样的内存。它让八个进程不再各自囤积私有缓存。改变了什么,以及它对你有没有帮助。

从精确性、runtime 证据与生产条件对比 BF16 权重无损压缩和 8-bit GGUF 量化 AI 与智能体

LLM 权重无损压缩 vs 8-bit GGUF:哪些已具备生产条件?

基于事实比较 GLM-5.2、BF16 精确解码、Q8 量化、既有系统、runtime 证据、集群经济性与 14 天 pilot。

付费试点、概念验证与设计合作伙伴的商业证据对比 产品与 MVP

付费试点、PoC 与设计合作伙伴:哪个能验证需求?

根据技术可行性、客户学习或付费意愿选择验证方式,并提供七项付费试点评分与合同简报。

多层 AI Agent 评测沙箱,包含隔离计算、受控出站、临时凭据与带外监控 AI 与智能体

OpenAI 评测沙箱逃逸:测试网络安全 Agent 前的 12 项控制

经事实核查的事件分析与采购清单,覆盖多层隔离、出站、凭据、控制平面分离、benchmark 完整性、监控与取证备用方案。

并行 AI 编程智能体在同一代码库存储之上使用隔离的 Git worktree 或 Jujutsu workspace 交付与 QA

Git Worktree 与 Jujutsu:AI 编程智能体版本控制决策指南(2026)

面向采购决策对比代码库缓存、partial clone、Git worktree 与 Jujutsu workspace,并列出兼容缺口、成本指标和可衡量的 14 天试点。

Cisco Antares 在不把代码库发上云的情况下把 CWE 描述映射到候选文件 AI 与智能体

Cisco Antares 评测:不上云的本地漏洞定位

面向采购决策核查 Antares-1B、VLoc Bench、GGUF 与 llama.cpp、本地 CWE 初筛、CI/CD、安全边界和可衡量的 14 天试点。

Meterless 围绕 AI 智能体连接 H-MEM、World Model、Markovian 推理与 Scout AI 与智能体

Meterless 评测 2026:AI 智能体上下文层能否用于生产?

面向买方核查 H-MEM、World Model、Markovian 与 Scout,区分模型化 token 节省、许可证边界、生产缺口,并给出两周试点。

按项目适配度对比六家蒂罗尔软件开发机构 商业与监管

2026 年蒂罗尔软件开发机构对比

明确披露商业利益,只使用官方来源,按项目适配度对比 Wavect、IDUS、CreativeSystems、styleflasher、Frankford's IT 与 westSite,不设置通用排名。

AI 智能体 SLA 用可量化任务结果连接准确率、延迟、人工接管、审计 trace 与合同补救 商业与监管

AI 智能体 SLA 模板:准确率、延迟、人工接管与可审计性

可直接复制的采购合同附件,覆盖任务成功、重大幻觉、工具调用、p95 延迟、人工接管、依赖故障、模型变更、trace 保留、事件等级与补救措施。

Nemotron 3.5 ASR 把多语言音频流转成带标点文本,并通过自托管生产门槛 AI 与智能体

NVIDIA Nemotron 3.5 ASR:免费自托管 STT 能否用于语音智能体?

面向采购方核查 80 ms、40 个 locale 的真实限制、H100 并发经济性、OpenMDW 许可证、Whisper 取舍与可量化生产试点。

从固定 token 开销、缓存、团队控制与每次成功任务成本比较 Claude Code 和 OpenCode AI 与智能体

Claude Code vs OpenCode:2026 年团队用哪个更省钱?

面向采购方比较实测 harness 固定开销、缓存经济性、套餐与 BYOK、企业控制,并给出可复现的每次验收成功成本评测方法。

面向欧洲企业的 Kimi K3 API 生产评测 AI 与智能体

Kimi K3 企业评测:API 价格、数据合规与试点清单

面向采购方核查 K3 定价、独立表现、新加坡数据位置、公开条款差异、API 集成限制、自托管现实与两周可测量试点。

Mesh LLM 把一个大模型按连续层切分到三台电脑 AI 与智能体

Mesh LLM 评测:一个大模型能否跨多台电脑运行?

面向采购决策的分布式本地推理评测:Skippy 如何用 layer stage 组合内存,为什么容量不等于加速,benchmark 能证明什么,以及如何安全试点。

包含 45 项证据与合同检查的欧盟 AI 供应商安全问卷 商业与监管

欧盟 AI 供应商安全问卷:签约前必问的 45 个问题

以证据为核心的 AI 采购清单,覆盖训练、保留、子处理者、区域、日志、权限、模型变更、事件、评估、删除、退出与欧盟 AI 法案角色。含多语言电子表格。

2026 DACH AI 采用基准,比较奥地利、德国与瑞士 商业与监管

DACH AI 采用基准 2026:中小企业真正投入生产的项目

汇总奥地利、德国和瑞士的公开采用率与用例数据,并指出生产率、预算、责任归属和闲置项目比例等尚未被公开调查覆盖的指标。

Graphify 知识图谱连接代码、数据、基础设施与文档 AI 与智能体

Graphify 2026 评测:代码库知识图谱值得引入吗?

面向采购的 Graphify 评测:与搜索及 RAG 对比,核查架构、隐私边界、评测局限、真实成本和两周试点评分。

Bonsai 27B 用 1-bit 权重把 54 GB 本地模型压缩到手机级体积 AI 与智能体

Bonsai 27B 评测:270 亿参数 LLM 真的能在手机上运行吗?

面向采购决策的核验:1-bit 与三值版、完整内存、能力损失、手机与 WebGPU 速度、商业场景和试点门槛。

包含 12 项指标的 AI 试点终止或扩展评分卡 AI 与智能体

AI 试点终止或扩展评分卡:运行 30 天后检查的 12 项指标

提供公式、硬门槛和完整案例,覆盖成本、自动化、失败、延迟、采用率、可审计性、数据准备和回收期。

Soofi S 欧洲主权大模型采购评估 AI 与智能体

Soofi S:德国主权大模型准备好商用了吗?

德国新推出的 30B 稀疏模型在德语和代码上表现突出,但公开版本仍是许可证不完整的 gated preview。本文核查评测、开放程度、基础设施、替代方案和试点清单。

按 OWASP APTS 评测 T3MP3ST 自主 AI 红队系统 AI 与智能体

T3MP3ST 2026 评测:它能取代渗透测试吗?

面向采购决策的评测:区分有基准的 single-agent 能力与未验证的 swarm,对照 OWASP APTS,并为 CTO 给出安全试点方案。

Vibe coder 与初级开发者在 AI 辅助工程系统中走向不同路径 领导力与团队

Vibe Coder 是新一代初级开发者吗?

只会接 ticket 的传统初级岗位正在收缩,但初级开发者并未消失。本文结合劳动力数据,解释 prompting 与工程的差别,并给出 AI 原生人才招聘模型。

软件产品前 30 天发现缺陷的外部 QA 基准 交付与 QA

外部 QA 基准:软件产品前 30 天通常会发现什么

基于公开研究的缺陷基准,覆盖权限、回归、浏览器与设备组合、数据完整性、AI 故障和生产逃逸,并解释为什么不存在诚实的通用 bug 数量中位数。

编程语言汇入运行时、内存与架构决策 交付与 QA

编程语言没那么重要了,软件工程却更重要了

AI 让语法、样板代码与跨语言翻译变便宜,却没有抹去运行时、内存、并发、安全与维护取舍。CTO 与工程师现在真正应该优化什么。

Colibri 在消费级硬件上把 GLM-5.2 专家从 NVMe 流式加载到 RAM 与 VRAM AI 与智能体

Colibri 让消费级硬件跑起 GLM-5.2,代价是什么?

Colibri 通过从 370 GB 的 int4 checkpoint 流式读取专家,用约 25 GB RAM 执行 7440 亿参数 MoE 模型。本文只谈实测速度、SSD 损耗、缓存规律、GPU 边界、模型支持和真正适用的场景。

企业软件的未来:AI 让系统工程回归,去中心化让架构保证变得可证明 交付与 QA

企业软件的未来

企业软件碎裂成分布式单体与 SaaS 蔓生。Alexandre Kotcherguine 与 Kevin Riedl 论证 AI 如何让全系统工程重新变得可负担,以及去中心化如何把架构承诺转化为可独立验证的保证。

带批注的软件开发公司提案:影响价格、范围与所有权的十二项条款 商业与监管

软件开发公司提案拆解:影响价格、范围与所有权的 12 项条款

逐条拆解一份虚构的 EUR 96,000 软件提案:验收、知识产权、变更、质保、依赖、托管、第三方许可、交接、终止、安全、分包商与完成定义,并附 24 分审查表。

对比 Coinbase、Stripe、Cloudflare、AWS 与 Circle 的 x402 支付实现 Web3 与隐私

x402 支付协议指南:Coinbase、Stripe 与主流方案

x402 把 HTTP 402 变成面向 API、MCP 工具与 AI 智能体的支付协商。本文按层、网络、费用、合规和生产风险对比 Coinbase、Stripe、Circle、Cloudflare、AWS、thirdweb、PayAI 与自托管。

Open Knowledge Format 将企业知识变成 AI 智能体可读取的可移植 Markdown AI 与智能体

Open Knowledge Format(OKF):企业实施指南

Google Cloud 的 OKF v0.1 草案用相互链接的 Markdown 与 YAML 组织企业知识。本文详解架构、与 RAG 和 MCP 的区别、局限与低风险试点方法。

DACH SaaS 软件维护成本基准:上线后的第一、第二和第三年 交付与 QA

软件上线后维护要花多少钱:DACH SaaS 基准

DACH SaaS 上线后维护成本基准:第 1、2、3 年分别拆分 bug 修复、依赖升级、云、可观测性、安全、合规、支持、产品迭代和紧急工作,并附交互式计算器。

智慧城市软件架构:MQTT、ChirpStack、LoRaWAN、Kubernetes 与 Terraform 交付与 QA

智慧城市软件架构:MQTT、LoRaWAN、Kubernetes 与 Terraform

面向生产的智慧城市平台中立指南:边缘侧 MQTT,私有传感器网络中的 LoRaWAN 与 ChirpStack,互操作边界的 FIWARE/NGSI-LD 与 SensorThings,可重复基础设施的 Terraform,以及只有在团队能运维时才使用的 Kubernetes。

AI Agent 每行动成本:按支持工单、发票、PR review 和 lead enrichment 衡量业务结果 AI 与智能体

AI Agent Cost per Action:为什么 agentic 工作流会推高 token 账单

管理层买的不是 token,而是行动:解决的支持工单、提取的发票、review 的 PR、补全的 lead。这份计算器把模型调用、工具调用、重试、验证器、cache hit 和失败尝试折算成每个成功行动的成本。

本地模型什么时候胜过 API:欧盟企业 LLM 自托管盈亏平衡计算器 AI 与智能体

本地模型什么时候胜过 API:欧盟企业盈亏平衡计算器

LLM 自托管只有在利用率、治理和运维同时成立时才会胜出。这份计算器用来比较 API 支出、GPU 小时、工程时间、eval 维护、并发和欧盟数据驻留。

2026 年 LLM 成本计算器:每任务成本、prompt caching、batch、routing 和自托管 AI 与智能体

2026 年 LLM 成本计算器:算任务,不算 Token

真实 AI 账单背后的表格逻辑:统计完成任务,而不是只看 token 单价。覆盖缓存输入、batch 折扣、路由升级率、自托管利用率、重试、人工返工和 eval 质量。

工厂归来:AI 复活软件工厂之梦,治理决定敏捷能否幸存 交付与 QA

工厂归来

Agentic AI 如何复活失败过两次的软件工厂之梦,敏捷能否在其中幸存。Alexandre Kotcherguine 与 Kevin Riedl 权衡技术债与生产力两侧的证据,追溯手艺沿栈上移进入规格说明与质量关卡,并把 Stripe 的智能体舰队读作论点在生产环境中的实证。

在 2026 年用零知识证明与 FHE 构建真实应用:一份务实指南 Web3 与隐私

在 2026 年用 ZK 和 FHE 构建真实应用:一份务实指南

Apple 在数百万部 iPhone 上跑 FHE,Google Wallet 用 ZK 证明你的年龄,可从技术出发的项目大多仍然失败。决策树、诚实的 2026 年成本数字,以及我们在隐私技术项目里见到的五种失败模式。

2026 年的零知识证明:zkVM、客户端证明与什么达到了生产就绪 Web3 与隐私

2026 年的零知识证明:什么真正达到了生产就绪

证明一个以太坊区块的成本一年内从 1.69 美元跌到不足 4 美分,ZK 身份落进了 Google Wallet。该在哪些 zkVM 上构建、证明要花多少钱、手机上能跑什么,以及安全的尸体都埋在哪里。

2026 年的全同态加密:什么在生产环境里交付,什么还是炒作 Web3 与隐私

2026 年的全同态加密:什么能交付,什么还是炒作

FHE 跑在 iPhone 上、在以太坊上结算加密交易,却仍比明文慢三到四个数量级。行得通的生产模式、诚实的开销数字,以及加密 LLM 的现实核查。

ZK vs FHE vs MPC vs TEE:写给架构师的 2026 年决策框架 Web3 与隐私

ZK vs FHE vs MPC vs TEE:2026 年怎么选

四项隐私技术、四种信任模型、四张价签。选出对的那一个的四个问题、一张附诚实数字的并排对比,以及越来越多地逼你做出选择的欧盟监管。

解读 Open USD:来自 Visa、Mastercard、Stripe 等的联盟稳定币 Web3 与隐私

解读 Open USD:一个联盟稳定币改变了什么

Visa、Mastercard、Stripe、Coinbase 和 BlackRock 支持了一种共享储备的稳定币,Circle 随之下跌 16% 到 18%。Open USD 究竟改变了什么,这枚币为何尚未上线,以及在任何稳定币上构建之前你该检查什么。

把提示词渲染成图像以降低 LLM 成本:诚实解读 pxpipe 技巧 AI 与智能体

把提示词渲染成图像,把 LLM 成本砍掉 60%:天才还是荒诞?

一个走红的技巧把系统提示词和历史渲染成 PNG,让 Fable 5 的账单降低 60%,因为图像按像素计价,而不是按文本。其中的物理是真的,且有 DeepSeek-OCR 研究支撑。坑在于:它有损且会无声地出错,精确的值必须保持为文本。

每 token 成本与每任务成本:更低的单价,仍可能带来更高的总账单 AI 与智能体

每 token 更便宜。每个答案更贵。

Sonnet 5 的每 token 单价比 Opus 4.8 更低,但在完整基准测试中,每完成一个任务的成本反而更高。为什么真正决定账单的是每任务成本,而不是每 token 单价。

用 Claude Fable 5 写代码:在 Fable、Opus、Sonnet 和 Haiku 之间做模型路由 AI 与智能体

Fable 回来了。这才是用它写代码的正确方式。

Fable 5 再次可用,但背后是更严格的分类器,有时会回退到 Opus 4.8。别把它当自动补全用:把它用在架构、迁移规划和最终审阅上,其余的路由给更便宜的模型。

Anthropic 对开源 AI 的战争,其实是一场关于智能成本的较量 AI 与智能体

Dario 向开源宣战。真正的战争,是关于你那张 AI 账单。

Anthropic 指控中国实验室窃取它的模型,并请华盛顿介入。剥掉地缘政治,这是一场关于智能价格的仗。Coinbase 已用开源权重和路由把 AI 账单砍掉 50%。我们的解读,以及欧盟的对冲。

敏捷去工程化与企业工程文化的侵蚀 交付与 QA

敏捷去工程化

一场旨在解放工程师的运动,如何反而侵蚀了企业的工程文化。Alexandre Kotcherguine 与 Kevin Riedl 追溯商业化、仪式捕获、指标倒置和工程手艺侵蚀的完整机制。

2026 年 DACH 内部 AI 助手成本 AI 与智能体

2026 年 DACH 地区的内部 AI 助手到底要花多少钱

Embedding、向量库、token、托管,以及所有人都忘记的维护项。一份面向 DACH 公司的方向性每席位成本拆解。

在 AI 时代用最小可信产品取代传统 MVP 产品与 MVP

MVP 已死。请构建最小可信产品。

AI 降低了原型成本,却没有降低产品判断的难度。粗糙的传统 MVP 如今可能污染它本应收集的信号。本文提出一种更小、更完整、更可信,并能产生决策级证据的首版产品。

2026 年 LLM 网关对比 AI 与智能体

2026 年 LLM 网关对比:LiteLLM vs OpenRouter vs Portkey vs RouteLLM

一个端点覆盖多家供应商,把回退、缓存、花费上限和路由收在一处。LiteLLM、OpenRouter、Portkey 和 RouteLLM 有何区别,以及怎样按约束你的那条限制来选。

在欧盟自托管开放权重 LLM AI 与智能体

在欧盟自托管 LLM:开放权重模型何时才真正划算

GPU 是便宜的部分。这里讲清自托管的真实成本、相对托管 API 的每天 token 盈亏平衡点、数据驻留何时逼你出手,以及 vLLM 生产栈。

2026 开源权重 LLM 对比 DeepSeek vs Qwen vs Kimi vs GLM vs Llama AI 与智能体

2026 开源权重 LLM 对决:DeepSeek vs Qwen vs Kimi vs GLM vs Llama

DeepSeek、Qwen、Kimi K2、GLM 与 Llama 在价格、编码与推理质量、上下文窗口、许可证和欧盟自托管上的对比,以及我们在上线一个模型前所用的决策顺序。

一份关于 2026 年奥地利 AI 咨询的诚实指南 商业与监管

2026 年奥地利 AI 咨询:面向中小企业的诚实指南

AI 咨询究竟包含什么、2026 年成本几何、哪些应用场景有回报、EU AI Act 当下要求什么,以及资助如何运作。这是工程视角,而非销售话术。

为什么软件真正的瓶颈是上下文,而不是智能 AI 与智能体

瓶颈从来不是智能,而是上下文。

乐天让一个编程智能体在 vLLM 上跑了七个小时,准确率 99.9%。真正的教训不是那几个小时,而是瓶颈是上下文而非智能,以及指挥智能体成了新的深度工作。

为 DACH 企业对比 ChatGPT Enterprise、Microsoft 365 Copilot 和自建 RAG AI 与智能体

DACH 企业怎么选:ChatGPT Enterprise vs Copilot vs 自建 RAG

扎根 M365 选 Copilot;数据分散选 ChatGPT Enterprise;只有要完整控制力才自建 RAG。三者单独都不符合 GDPR,您仍是数据控制者。2026 年年中现状。

在各类欧盟驻留方案中,你的 AI 数据存储与处理位置 商业与监管

2026 年 AI 应用的欧盟数据驻留对比

OpenAI、Azure、Mistral、Hetzner 还是自托管?几乎人人忽略的陷阱:欧盟数据驻留通常指数据存储在欧盟,而非模型在欧盟运行。

针对用 Lovable、Bolt 和 Replit 构建的应用的安全、知识产权与投资准备 交付与 QA

Lovable、Bolt 和 Replit 应用尽职调查

在以 AI 构建的应用去融资或出售之前,三个问题决定它能否过关:它安全吗,归你所有吗,可维护吗?这是安全、知识产权与投资准备清单。

2026年奥地利AI资助的四条路径 商业与监管

2026奥地利AI资助:aws、FFG、研究奖励、KMU.DIGITAL

2026年奥地利AI资助的四条路径,诚实评估:aws用于引入,FFG用于研发,14%研究奖励,以及KMU.DIGITAL。还有无人提及的难处:开放窗口与剩余预算。

如何在 2026 年把 AI 落地到团队内部而不沦为摆设 领导力与团队

如何在 2026 年把 AI 落地到团队内部

大多数内部 AI 落地都沦为摆设。我们应用的顺序:教育团队,梳理真实流程,定好成本与合规,把一个工作流做到生产级,再交接出去让你的团队真正掌控它。

MCP、RAG、Agent Skills 与 Custom GPTs 作为一个 AI 系统的不同层 AI 与智能体

MCP vs RAG vs Agent Skills vs Custom GPTs

不是同一问题的四个答案,而是四个层:RAG 提供知识,MCP 提供连接性,Skills 提供流程,Custom GPTs 是打包界面。一份决策树,以及为何大多数情况下应组合而非择一。

Fractional CTPO 对比一位 fractional CTO 和 CPO 领导力与团队

Fractional CTPO 对比 CTO 和 CPO

一个同时掌管产品与工程的合并脑袋,何时胜过分别招 fractional CTO 和 CPO,八名工程师的拆分点,以及单点故障的取舍。

融资前 AI MVP 的技术尽职调查清单 产品与 MVP

融资前 AI MVP 的技术尽职调查

投资者在 AI MVP 中检查什么:作为证据的评估、版本管理、推理成本、数据权利、EU AI Act,以及融资前应备好的交接资料。

Vibe-Code 生产就绪清单 交付与 QA

Vibe-Code 生产就绪清单

一份独立、可快速浏览的清单,在真实用户接触之前检查任何 AI 生成应用。十项检查按咬人频率排序,分为阻断、高危和清理。

把 vibe-coded 应用做到生产可用要花多少钱 交付与 QA

把一个 vibe-coded 应用做到生产可用要花多少钱?

按产品类型的工作量区间、时间真正的去向,以及审计通常会发现什么,以钱和时间线呈现。加固是花费,审计先告诉你它的规模。

Fractional CPO vs 资深产品经理 领导力与团队

Fractional CPO vs 资深 PM

Fractional CPO、资深 PM 和先谁都不招各自到底负责什么。从 PM 到 CPO 的进阶,以及为什么大多数早期创始人一个都不需要。

在奥地利什么时候招 Fractional CPO 领导力与团队

什么时候招 Fractional CPO

一个诚实的框架。PMF 之后的触发点、创始人是否愿意交出产品决策权、什么时候适得其反,以及 freier Dienstvertrag 合同形式。

面向小型德语区企业的一页式 AI 使用政策 商业与监管

面向德语区中小企业的一页式 AI 政策

您的团队早已在用 AI。与其写 27 页,不如写一页会被读完的内容:获批工具、数据规则、培训(欧盟《人工智能法案》第 4 条)、人工复核、披露与一位负责人。附可直接复制的模板。

如何在 2026 年降低 LLM token 成本 AI 与智能体

如何在 2026 年降低 LLM Token 成本

Token 价格下来了,但带 agent 的产品账单依旧很高。我们按顺序执行的实战手册,缓存、批处理、路由、选对模型(含中国开源权重 frontier 模型)以及上下文压缩。

面向中小企业的 AI 智能体 30/60/90 天生产上线计划 AI 与智能体

30/60/90 天 AI 智能体试点:上线计划

一次现实的 AI 智能体上线大约需要 90 天。计划是:界定范围、降低风险,以影子模式构建,在批准关卡下投入有限生产环境,并把所有权干净地移交给团队。

一位兼职 CTO 在初创公司前 90 天的执行计划 领导力与团队

兼职 CTO:30/60/90 天计划

您已经聘请了一位兼职 CTO。前 90 天究竟应当产出什么?评估、规划、执行,并留下一个仍在运转的系统以及能在他离开后留存的交付物。

带验收标准、评测集与上线门槛的 AI MVP 范围模板 产品与 MVP

AI MVP 范围:验收标准、评测集与 SoW

对 LLM 而言,“它能用”不是验收标准。四样东西必须写进 SoW:评测集、带阈值的目标指标、上线门槛,以及不确定情形的处理。附可直接复制的模板。

面向 SharePoint、Confluence 和 Google Drive 的权限优先 RAG 架构 AI 与智能体

面向 SharePoint、Confluence、Drive 的权限优先 RAG

企业级 RAG 真正的难题是权限,而非检索质量。如何在检索层强制执行访问控制、把 ACL 带到每个 chunk 上,并避免泄露。

AI 生成代码的 QA,上线前会出什么问题 交付与 QA

AI 生成代码的 QA

Lovable、Cursor、Claude Code 和 Replit 生成的代码在上线前会在哪里出问题,以及我们用来排查的生产就绪清单。

从 Lovable 和 Cursor 原型到生产 交付与 QA

从 Lovable 和 Cursor 原型到生产:迁移清单

做到 demo 很快。做到生产是一个独立的项目。这是我们用来给 AI IDE 原型做加固的清单,涵盖认证、数据、密钥、托管,以及保留还是重建的抉择。

vibe-coded 软件审计,上线前会出什么问题 交付与 QA

Vibe-Coded 软件审计:上线前会出什么问题

你上线了从没读过的软件。这是我们对 AI 生成代码所做的结构化通读,我们最先检查的七件事,以及什么会卡住上线、什么可以等。

面向欧盟企业的 RAG 生产就绪清单 AI 与智能体

面向欧盟企业的 RAG 生产就绪清单

做一个 RAG demo 很容易。做一个可信赖、在 GDPR 与《AI 法案》下站得住脚、又付得起的 RAG 助手则不然。这是我们在上线前会跑的检索、锚定、成本、合规与安全检查。

按适配、价格、时间线和案例对比奥地利 MVP 开发机构 商业与监管

奥地利初创企业 MVP 开发:2026 供应商、成本与选择

基于第一方来源,对比八家奥地利 MVP 开发机构的适配、公开价格、时间线、服务范围和案例。Wavect 披露商业利益,未公开信息不做推断。

2026 年在奥地利做一个 AI MVP 要多少钱 产品与 MVP

2026 年在奥地利做一个 AI MVP 要多少钱?

按层级划分的诚实 EUR 区间、把数字推高或拉低的因素、自建/购买/微调的判断、人们忘掉的持续成本,以及奥地利的资助叠加如何改变真实价格。

什么时候不该雇用 Wavect 商业与监管

什么时候不该雇用 Wavect

一份诚实的清单,列出 Wavect 不是对的人选的六种情况、该转而找谁,以及我们真正最擅长的那一小块工作。

软件工作室能否申请奥地利的 Forschungsprämie 商业与监管

软件工作室能否申请奥地利的 Forschungsprämie?

奥地利的 Forschungsprämie 以现金返还符合条件研发成本的 14%,即使亏损也能拿到。哪些开发成本算数、什么会被 FFG 驳回,以及它与德国 Forschungszulage 的对比。

什么时候值得构建 LLM 评测 AI 与智能体

什么时候值得构建一套 LLM 评测?成本、ROI 与信任裁判

当风险、调用量和 prompt 变更频率超过测试框架的成本时,构建 LLM 评测才值得。模型账单是每次运行几美元;真正的成本是一个你能信任的数据集和裁判。

为什么跨链桥不断被掏空 Web3 与隐私

为什么跨链桥不断被掏空

Ronin、Wormhole 和 Nomad 三者合计损失超过 11 亿美元。根源是信任模型,而不是代码。以及,你到底需不需要一座桥。

aws Preseed + FFG + Forschungspraemie 奥地利资助叠加 商业与监管

奥地利创业资助究竟如何叠加

aws Preseed、FFG Basisprogramm 和 14% 的 Forschungsprämie 可以合法叠加,但双重资助规则会抵消重叠的欧元。上限、完整算例,以及申请的顺序。

React Native vs Flutter:必须在本地招聘的 DACH 创始人该怎么选 交付与 QA

React Native vs Flutter:必须在本地招聘的 DACH 创始人该怎么选

每个对比都跳过的变量是:在因斯布鲁克、维也纳、慕尼黑或苏黎世你实际能招到谁。为什么 React Native 通常赢下 DACH 的招聘数学。

LoRaWAN vs NB-IoT vs Sigfox IoT 传感器试点成本 交付与 QA

LoRaWAN vs NB-IoT vs Sigfox:如何为 IoT 传感器试点编制预算

一个决定主导你试点 80% 的成本,而且不是无线本身。你拥有的私有网络 vs 你租用的运营商订阅,附一个完整的 TCO 交叉算例。

编排 AI 代理时,专注力成为新的瓶颈 领导力与团队

专注力是新的瓶颈

LLM 把瓶颈从打字搬到了专注力。编排上限、N 个代理之后的七种失败模式,以及我们如何控制代理数量。

外部审计前的智能合约安全检查清单 Web3 与隐私

智能合约安全检查清单(30 项)

我们在 Solidity 代码送外部审计前会跑的 30 项内部清单。编译器、访问控制、重入、gas 攻击面。

奥地利 Fractional CTO 日费率 领导力与团队

奥地利 Fractional CTO 日费率

因斯布鲁克、维也纳、林茨的 Fractional CTO 真实日费率区间。Pre-seed、Seed、Series A、scale-up 阶段每天的欧元到底买到什么。

5 人创业团队的 EU AI Act 合规成本拆解 商业与监管

5 人创业团队的 EU AI Act 成本

3 万到 8 万欧元的逐项拆解。法律审查、风险分级、技术文档、合规评估、数据治理、上市后监控。

奥地利 SaaS 创始人面对的 Werkvertrag 与 T&M 选择 商业与监管

奥地利 SaaS:Werkvertrag vs T&M

谁承担范围风险、ABGB 下验收怎么走、账务上各自怎么处理,以及奥地利项目何时该选哪种合同模型。

已上线产品中有多少失败,以及无聊的中间地带 产品与 MVP

我们交付的产品。多少失败了

Wavect 交付产品的整体结果分布。多少做到了规模化、多少被下线、多少落在不上不下的中间地带。

21 个 Web3 项目的 gas 成本复盘 Web3 与隐私

21 个 Web3 项目。Gas 成本复盘

21 个项目里 gas 成本到底烧在了哪里,以及今天我们会怎么选链。Ethereum、Arbitrum、Optimism、Polygon、Base、Solana 横向对比。

固定价与 T&M 项目的 scope creep 比率 商业与监管

Scope Creep 比率。真实数字

固定价与 T&M 项目里实际的范围变更频率。为什么签字的 Werkvertrag SoW 才是合同的关键,而不是价格本身。

在奥地利,何时 Fractional CTO 比招人更划算 领导力与团队

何时 Fractional CTO 胜过招人

奥地利招一位资深 CTO 的全负载第一年成本,对比 Fractional 顾问月费。各自什么时候赢,什么时候是错的选择。

2026 年奥地利 Web3 创业团队面对的 MiCA 与 FMA 现实 商业与监管

奥地利 2026:MiCA + FMA 现实

从工程视角看奥地利加密合规手册。CASP 分类、资本下限、FMA 接触点,以及创始人反复问的那些问题。

DACH SaaS 创始人面对的 GDPR 与 EU AI Act 叠加 商业与监管

DACH SaaS:GDPR + EU AI Act

5 人团队的合规叠加。Annex III 风险判定决策树,加上一张谁负责哪项控制的责任矩阵。

为什么 40% 的 AI 代理项目被叫停 AI 与智能体

为什么 40% 的 AI 代理项目会死

我们在 AI 代理项目里反复看到的八种模式。它们长什么样、怎么把项目搞死,以及早期发现时的低成本修法。

2026 年 RAG、fine-tuning 与 long-context 的成本交叉点 AI 与智能体

2026:RAG vs Fine-Tuning vs Long-Context

决策树已经变了。新的交叉点在哪里,以及 100MB 语料库、每月 10k 次查询的欧元成本模型。

2026 年 LLM API 成本下降 80% AI 与智能体

2026 LLM API 成本:架构要变

token 已经便宜了,架构要跟着价格曲线走。上下文窗口巨大、路由成为关键的 2026 年,要做的七步动作。

Ethereum 到 Solana 迁移成本拆解 Web3 与隐私

Ethereum 到 Solana 迁移成本

Ethereum 到 Solana 迁移的实话拆解。账户模型、EVM 到 SVM 工具差距、indexer 重建、钱包 UX、代币标准、重新部署成本。

加密之外的零知识证明用例 Web3 与隐私

加密之外的零知识应用

六个非加密的 ZK 用例。隐私保护的 KYC、年龄验证、供应链溯源、私密凭证、机密 ML 推理。

生产环境中的账户抽象 ERC-4337 Web3 与隐私

生产环境的账户抽象

ERC-4337 修好的六件事,对比它修不好的六件事。再加上 EIP-7702、bundler 中心化风险,以及 paymaster 经济模型。

Road to PMF 产品与 MVP

通往产品市场契合的道路

人人都在谈PMF,几乎没人能做到。保证你永远无法实现PMF的最快方式?从第一天就专注于错误的事情。

Feature fabric 产品与 MVP

逃离功能陷阱

大多数产品死于功能过多,而非过少。以下是如何停止什么都做,开始专注于真正重要的那件事。

Software a breathing organism header 交付与 QA

软件:一个有生命的有机体

软件永远没有完成的一天,但大多数公司还是把它当成「能做完」来做预算。以下是如何停止烧钱,开始打造用户口口相传的产品。

Test Driven Development 交付与 QA

为什么测试驱动开发值得投入

测试给人留下了一个假象:它成本高、拖慢开发速度、阻碍工程部门。而现实是,它能为你省下大钱。

Software Project Budgets Header 商业与监管

为什么人们觉得外包公司很烂

软件有缺陷、截止日期一拖再拖、账单出乎意料。这些噩梦都是真实的,但外包公司真正的问题可能不是你想的那样。

Agile Fixed Pricing Header 商业与监管

软件项目定价的正确方式

所有人都讨厌按小时计费,所以他们要求固定价格。问题是,软件项目的固定价格同样有缺陷。

只收重要内容

关注与你相关的内容

每当我们发布新文章,你会收到一封简短邮件。你可以关注整个博客,也可以只选感兴趣的主题。

你希望接收哪些内容?
选择主题

免费、双重确认、不使用跟踪像素。

本期结束 №108 · 每两周一篇来自一线的实战分享。