之前自己手搓了一个本地 AI 音乐工作台,吾音 muin 。 它不是几十行的测试 Demo:里面有 Electron、React、Python、MiniMax 音乐生成、TTS、声音克隆、300 个结构化音乐模板、作品库、波形编辑、Agent/MCP 和多个本地模型 Sidecar。 乘着kimi k3发布,实际找来 9 个 AI 模型,让它们对这一个真实项目做了一场全方位项目审查: ChatGPT 5.6 Sol Kimi K3 GLM-5.2 Fable 5 Grok 4.5 MiMo v2.5 Pro MiniMax M3 DeepSeek v4 Pro Qwen 3.7 Max 提示词完全相同:让他们生成审查报告。 然后按六个维度评分:事实证据、产品洞察、风险发现、执行方案、调研可信、输出严谨。 刚面世的Kimi K3确实可以,类似的模型同测我也做过,kimi K2.6一直排名倒数,但这次稳居前三,甚至在ChatGPT 打分中直接压过fable 5。 它的文字不一定最华丽,但代码证据密度很高,尤其擅长发现 JSON 数据丢失链、Sidecar 的真实状态和本地工程问题,最终排在第 2。 ChatGPT 5.6 Sol 排在第 1。它的优势不是单项最夸张,而是能把代码、实际界面、API、模板、依赖和法规串成一套完整判断,并且最清楚应该先修什么。 GLM-5.2 排第 3,像一位严谨的高级工程师;Fable 5 的红队能力很强,但它也给了我这次最深刻的教训:AI 能发现秘密,也可能把秘密复制到更多地方。 当然,我这是用ChatGPT 对最终报告进行了打分,总体还是很客观的,不同模型评分数和排名会有不同,但k3还是和ChatGPT ,fable 5稳居第一梯队。相比2.6那肯定进步显著! 后续这个项目改造完成也会上线,对AI生成音乐感兴趣的朋友也可以私信我,后续可以第一时间试用。#AI音乐 #AI音乐生成 #Kimi #kimi #kimik3生万物 #howto用AI手搓APP #AI芒造梦计划
K3 项目审查能力实测!比肩 fable 5
作者:K3 项目审查能力实测!比肩 fable 5