首页
社区
课程
招聘
[原创] KCTF2026 - 第三题 午时·永数囚笼 讨论
发表于: 1天前 186

[原创] KCTF2026 - 第三题 午时·永数囚笼 讨论

1天前
186

### 题外话


这里先致敬一下作者对反 AI SLOP 的探索 :-)


本题没有无聊的假 flag 或者不合规字符串,而是(按笔者对这题浅薄的理解来说)有许多的诱饵分支,这些分支看起来有机会可解,引诱本就偏好依赖 Z3 的大模型去浪费时间尝试各种 SAT 问题,而这些问题是有限时间内不可能解出的。  

与此同时,真正的可解分支也有一些简单的映射关系(虽然单独给今天的 LLM 大概率还是秒出),但藏在别的更加容易吸引 LLM 的验证后面之后看起来确实非常非常有效。


### 题解...题解 Prompt


虽然讲了些有的没的 笔者还是很懒(或者不如说笔者已经很难想象有什么逆向任务是无法用自然语言描述然后让 LLM 高效完成的了)。  

~~对于现在的旗舰模型,大部分时候甚至去年各种潮流的 MCP 都显得有些多余了~~    


最后笔者还是用总计198个汉字的 prompt 做完了这题,完整 prompt 如下:


```

来做这个看雪CTF 2026逆向题。

```

> worked 25 min


```

请继续 你可以独立完成解题。

```

> worked 140 min


```

这个逆向应该是真的双射可逆的 尽量不要使用符号执行。

```

> worked 155 min


```

为什么又开始SMT和上网搜无关内容了,这题也可能是多线,主线看起来是逆出来了校验逻辑 实际上高度难还原 咬住就解不出了。反而需要找到正确的支线反推。无论如何都应该完整逆清楚逻辑 然后再完成解题,加油,请独立完成解题。你可以搜索你觉得必要的东西但我觉得帮助不大。

```

> worked 134 min


```

请继续 加油

```

> worked 122 min

> 解出来了。最终 flag:

>**flag{v4_opaque_trace_2026}**


完整对话历史供各位师傅参考:  

80eK9s2c8@1M7s2y4Q4x3@1q4Q4x3V1k6Q4x3V1k6U0K9r3q4@1k6%4m8@1i4K6u0W2j5$3!0E0i4K6u0r3M7$3S2S2M7X3g2Q4x3V1j5$3j5e0N6W2j5K6R3H3x3#2)9J5k6r3f1K6k6o6S2Q4x3X3b7^5x3$3f1^5i4K6u0V1z5r3x3H3y4g2)9J5k6r3g2U0j5U0V1#2x3r3x3$3y4$3j5$3x3b7`.`.  


>(另外,笔者没有尝试如果一开始就要求模型总是先评估复杂度的话会不会有帮助)


### 后记


> 诚然,老派的逆向分析非常有趣,看有代码分析的 writeup 也会有一种和有趣的,聪明的灵魂对话的感觉  

>

> 但是,如果我不需要打开任何(浏览器以外的)工具,一行代码都不看就能拿到 flag,纯手工解题真的还会有 for fun 的感觉吗?

> 凡是 LLM 会的知识,我们所有人都自动“学”会了,“我会”和“LLM会”有什么区别呢?总不能说网络安全没有开卷考吧

> 有什么问题是我们能有信心说“这个底层知识 LLM 不会,需要人类专家知识介入”才能解决的?

>

> 3年前 DEF CON 31 决赛的时候,HypeBoy 在 live CTF 1v1 直播里掏出 angr 自动化秒掉了 Straw Hat,那时大家甚至还对传统自动化 CTF 感到有些陌生

> 直到去年 DEF CON 33 里 Blue Water 掏出 LLM 用 5min/48min 和 10min/40min 的夸张速度分别送走 NU1L 和 FMC 的传奇选手,大家似乎才意识到 LLM 真的可以拉爆顶尖人类选手

> 而今年 DEF CON 的 live 环节直接取消(大抵也是因为可以遇见的选手都会高度依赖 LLM,直播效果会很差的缘故吧)


笔者从去年起就对 CTF 的未来抱有深深的绝望,随着近几个月来模型安全任务能力的加速翻倍,这种绝望感尤甚


室友提醒笔者本题思路有些像今年 DEF CON 初赛的 PWN 题:给定目标看起来有多个漏洞,**但最明显的几个利用难度极大,几乎无法利用**,而大模型会觉得自己已经找到了一个很有说服力(不是没有希望解出)的路线,然后一条路走到黑。  

现在来看这类设计思路在三个月后的今天对抗 GPT-5.6 和 Deepseek V4 似乎仍有一战之力。  


这样来看,或许,CTF 未来方向的答案之一可能是设计依旧需要“*人类智慧*”来指导大模型“此时应该选择什么大方向”/“路线错了,更换角度”的题目。  

> 传统的“这一步需要什么技术”/“下一步做什么”以及大量的逆向、脚本、调试任务在笔者看来都几乎已经可以被大模型彻底取缔了。  

> 当然,如果最后其他师傅的题解出现完全一把梭的做法,那或许“*人类决策*”也不是那么必须了...虽然笔者相信目前本题的想法是很有趣的方向

 

无论如何,希望可以在接下来的比赛和未来的 CTF 里看到更多师傅们的类似探索,happy hacking!




传递专业知识、拓宽行业人脉——看雪讲师团队等你加入!!

收藏
免费 4
打赏
分享
最新回复 (2)
雪    币: 30369
活跃值: (16139)
能力值: ( LV15,RANK:2070 )
在线值:
发帖
回帖
粉丝
2

nb,请问大佬chatgpt用的什么模型和强度,怎么绕过cyber的审查?我在chatgpt上用 5.6 sol high疯狂cyber拒答(codex也一样),偶尔会抽风一下有一点的进展,但根本没法持续探索下去,甚至于后面发任何对话都会触发外置审查;不过从进展片段看,这题的复杂度似乎属于5.6 sol勉强能够到(是有实质化简和发现的;如果不触发cyber阻断,我感觉持续下去能做出来)、opus 5 / fable 5可能更轻松(claude家的模型思维深度更大)、5.6 terra和5.5以下的模型感觉不行(只会绕圈毫无进展)?

最后于 11小时前 被mb_mgodlfyn编辑 ,原因:
11小时前
0
雪    币: 220
能力值: ( LV1,RANK:0 )
在线值:
发帖
回帖
粉丝
3
牛逼
10小时前
0
游客
登录 | 注册 方可回帖
返回