新闻笔记 · IDAEO AI News

#AI开发工具

bubo公司推出QA工具「Nioh(仁王)」,用于在AI撰写的代码「发布前」进行审核;支持MCP的AI客户端可直接调用,正式版推出前率先开放限量先行测试

发布者:

TL;DR · 这代表什么

Nioh让开发者在发布前由AI审查代码正确性,现开放限量免费先行测试。

新闻正文

在AI大量生成代码与测试案例的开发现场,目前最耗费人力的环节,正是「判断AI写出的内容是否可以发布」这项工作。 尽管测试通过,仍可能遗漏缺陷、忽略需求,甚至在发布后才发现兼容性问题。 量产可由AI完成,但正确性的判断仍需仰赖人工。 专精于软件测试与品质保证的株式会社bubo(总部:大阪府大阪市中央区,代表取缔役:渡边博之)于2026年7月宣布,将其内部用于「判断正确性」的品质保证方法论,集成为可通过MCP(Model Context Protocol)兼容AI客户端(如Claude、Cursor等)调用的工具「Nioh(仁王/读音:におう)」,并正式推出。

以「为开发把关,注入品质智能」为理念,Nioh涵盖需求审查、测试设计、AI生成代码验证,乃至营运阶段的问题根源分析。 这些工具皆源自bubo自身日常开发所使用的实务方法。 正式版将以付费订阅制提供。 在此之前,bubo现正以面谈制方式,限量招募可优先体验功能的先行测试企业。 ■ 背景:AI能产出数量,但判断正确性仍是人类的工作常听人说「AI将取代人类工作」,但在2026年的开发现场,实际发生的却是相反情况:人类需逐一查看AI高速产出的代码与测试,所花费的时间反而增加。 bubo认为,「判断正确性的工作」将成为未来品质保证的内核。 因此,公司将自身在QA现场实践的流程,集成为可从本地AI调用的工具。

在先行测试阶段,bubo将与贵公司共同评估这些工具在实际流程中的有效性。 ■ 功能范围:涵盖从上游到营运的完整开发流程Nioh针对软件开发各阶段提供对应工具,整体架构对应典型的V型开发流程。

需求定义:在实作前,查看需求是否遗漏、模糊或未定义对象(如需求审查、需求格式重整等)设计阶段:找出影响范围或异常流程的疏漏,于设计阶段确立必要的测试观点与优先级(如设计审查、测试设计、测试优先排序、可追溯性检查等)实作与代码审查:比对AI撰写的变更是否符合需求、是否破坏既有功能,并在实作时即掌握因意外输入导致崩溃的弱点或公开API的非兼容变更(如AI变更验证、稳健性检查、API兼容性检查、完成条件检查等)测试阶段:辨识「虽通过却遗漏缺陷」的测试,或容易失败、不稳定的测试(如测试有效性评分、测试代码品质检查、不稳定测试侦测等)发布与营运:针对发生的缺陷深入挖掘根本原因,并将结果反馈至预防措施与添加测试案例(如缺陷分析等)例如,向AI变更验证工具提问「此PR是否符合需求?

」,系统将比对变更内容、需求文档与测试案例,指出需求未满足之处,以及是否修改了无关区域。 ■ 两种使用方式:对话中调用,或于CI自动拦截对话式调用:于开发过程中,从您使用的AI客户端(如Claude、Cursor)直接调用,即时取得审查意见与回馈。 CI自动运行作为品质关卡:具备通过/不通过判定功能的工具,可集成至GitHub Actions等CI系统,自动拦截未达标准的变更,形成「品质关卡」。 ■ 与一般询问AI有何不同? 或许有人会想:「审查工作,直接问AI不就好了? 」Nioh与通用大型语言模型(LLM)的差异在于以下三点:具备明确的审查观点:工具本身内置QA应检查的「观点」。

需求审查依USDM方法,测试设计则基于边界值分析、决策表等技术,确保检查视角一致且无遗漏,结果不受提示词撰写技巧影响。 结果明确且可重现:多数工具通过静态分析得出结果,相同输入必得相同输出,避免LLM常见的「每次回答不同」或「看似合理却错误(幻觉)」问题,仅在必要时才调用AI。 可传回通过/不通过结果,实现自动关卡:结果以结构化形式(如指摘事项、评分、通过/不通过)回传,可集成至CI系统自动拦截。 一般对话式AI的文本回应则无法机械化处理。 简言之,通用AI是「问了会回答」的工具,Nioh则是「知道该查什么、怎么查」的专业工具。 它将bubo在开发与QA现场累积的方法论,完整封装其中。

■ 提供方式与先行测试计划Nioh正式版将以付费订阅制提供。 本次招募的先行测试,是为让企业在正式版推出前优先体验功能的限量方案。 正式版:预计以付费订阅制提供(价格与方案细节尚未公布)。 先行测试:采面谈制的限量名额。 因需面谈,录取企业数量有限。 面谈中将共同评估适合贵公司流程的工具与导入顺序,并提供设置与串接方式。 测试期间免费使用。 正式版发布时测试计划即结束,参与企业将优先获得正式版导入信息。 ■ 为何免费提供先行测试? 在为正式版定价前,bubo希望实际了解各工具在开发现场的成效,并根据用户意见持续优化。 对bubo而言,这段期间是「验证是否真正有用」的关键阶段,优于定价考量。

正因如此,才以免费限量方式,邀请愿意提供坦率意见的企业参与。 ■ 如何保护外部机密代码? (BYOK)传递至工具的代码、规格与数据,bubo服务器不会保存,也不会用于自身模型训练。 LLM由用户自行提供密钥(BYOK=Bring Your Own Key),调用所选的服务供应商。 数据处理规范依用户与供应商的合约而定。 目前使用LLM密钥的工具支持Claude与Gemini,其他供应商将陆续支持。 因采用BYOK机制,使用LLM的工具所产生的API费用,将由用户依自身与供应商的合约另行支付(与bubo服务费用分开)。 此规则适用于测试版与正式版。 纯静态分析即可完成的工具,则不产生此类API费用。

工具分为三大类:(1)仅通过静态分析或统计完成、完全不调用外部LLM的工具(如测试有效性、稳健性、资源泄漏、API兼容性、可追溯性等);(2)以静态分析为主,必要时可并用LLM的工具;(3)需使用LLM进行判断或生成的工具(如需求审查、测试设计、AI变更验证等)。 用户可自行控制发送至AI的数据范围。 哪些工具会发送数据至外部LLM,哪些不会,通信

常见问题(FAQ)

Nioh適合哪些企業?

適合使用AI進行軟體開發的企業,特別是希望自動化品質保證流程的開發團隊。

LLM的API費用大約多少?

費用依供應商與使用頻率而定。純靜態分析工具不產生API費用。

正式版何時發布?

預計2026年內推出,確切時間未定。測試參與者將優先獲知。

導入需要多少人力?

面談中將提供最佳導入順序與設定方式,初期投入人力可降至最低。

資安措施是否完善?

採用BYOK機制,資料不存於bubo伺服器,由使用者透過LLM供應商合約管理。

今日小测

Nioh与一般通用AI的最大差异是什么?