首页
社区
课程
招聘
[原创]从 IoT 自动漏挖看智能体发展趋势:实测 DeepSeek-V4 VS Kimi 2.6 VS GPT 5.3 codex
发表于: 2026-5-5 00:27 10135

[原创]从 IoT 自动漏挖看智能体发展趋势:实测 DeepSeek-V4 VS Kimi 2.6 VS GPT 5.3 codex

2026-5-5 00:27
10135

冰与火的战歌:Windows内核攻防实战高级班!从零到实战,融合AI与Windows内核攻防全技术栈,打造具备自动化能力的内核开发高手。

收藏
点赞 69
打赏
分享
最新回复 (39)
雪    币: 0
能力值: ( LV1,RANK:0 )
在线值:
发帖
回帖
粉丝
2
666
2026-5-5 02:01
0
雪    币: 226
能力值: ( LV1,RANK:0 )
在线值:
发帖
回帖
粉丝
3
看看skill,参考下大神的skill
2026-5-9 12:09
0
雪    币: 188
活跃值: (2424)
能力值: ( LV11,RANK:190 )
在线值:
发帖
回帖
粉丝
4
很细致的对比实验,想请问下楼主有没有尝试过最新的claude 4.6和GPT 5.5呢,这两个模型似乎是在漏洞挖掘能力上相比上个版本有质的飞跃的;感觉agent的确需要人类引导漏洞挖掘方向,因为直接丢给它整个固件解包目录,很容易陷入某个挖不通的局部区域下就会放弃工作,据说是需要恰当的harness机制设计去自动引导它;已经完全感受到ai的进化带来的压力了hh,说不定以后ai模型足够先进的话,能搞一整套工作流把人类的活都做了
2026-5-9 15:03
0
雪    币: 0
能力值: ( LV1,RANK:0 )
在线值:
发帖
回帖
粉丝
5
666
2026-5-11 09:30
0
雪    币: 4231
活跃值: (4329)
能力值: ( LV2,RANK:10 )
在线值:
发帖
回帖
粉丝
6
学习一下
2026-5-11 16:47
0
雪    币: 200
能力值: ( LV1,RANK:0 )
在线值:
发帖
回帖
粉丝
7
nb
2026-5-14 00:17
0
雪    币: 153
活跃值: (60)
能力值: ( LV2,RANK:10 )
在线值:
发帖
回帖
粉丝
8
6666
2026-5-18 14:52
0
雪    币: 6590
活跃值: (3952)
能力值: ( LV2,RANK:10 )
在线值:
发帖
回帖
粉丝
9
学习一下
2026-5-26 09:29
0
雪    币: 25
活跃值: (506)
能力值: ( LV2,RANK:10 )
在线值:
发帖
回帖
粉丝
10
66666,学习
2026-5-28 10:11
0
雪    币: 30
能力值: ( LV1,RANK:0 )
在线值:
发帖
回帖
粉丝
11
学习一下
2026-6-3 11:13
0
雪    币: 203
能力值: ( LV1,RANK:0 )
在线值:
发帖
回帖
粉丝
12
6666
2026-6-3 11:16
0
雪    币: 220
能力值: ( LV1,RANK:0 )
在线值:
发帖
回帖
粉丝
13
学习一下
2026-6-8 05:46
0
雪    币: 1329
活跃值: (3255)
能力值: ( LV2,RANK:10 )
在线值:
发帖
回帖
粉丝
14
学习
2026-6-8 09:55
0
雪    币: 1631
活跃值: (2830)
能力值: ( LV5,RANK:75 )
在线值:
发帖
回帖
粉丝
15
学习一下
2026-6-8 10:13
0
雪    币: 204
能力值: ( LV1,RANK:0 )
在线值:
发帖
回帖
粉丝
16
学习
2026-6-8 10:43
0
雪    币: 35
能力值: ( LV1,RANK:0 )
在线值:
发帖
回帖
粉丝
17
学习
2026-6-8 10:56
0
雪    币: 231
活跃值: (280)
能力值: ( LV2,RANK:10 )
在线值:
发帖
回帖
粉丝
18
学习
2026-6-10 19:22
0
雪    币: 210
活跃值: (69)
能力值: ( LV2,RANK:10 )
在线值:
发帖
回帖
粉丝
19
学习
2026-6-13 00:04
0
雪    币: 106
活跃值: (250)
能力值: ( LV2,RANK:10 )
在线值:
发帖
回帖
粉丝
20
学习学习
2026-6-15 15:05
0
雪    币: 421
活跃值: (95)
能力值: ( LV3,RANK:20 )
在线值:
发帖
回帖
粉丝
21
是气球呀 很细致的对比实验,想请问下楼主有没有尝试过最新的claude 4.6和GPT 5.5呢,这两个模型似乎是在漏洞挖掘能力上相比上个版本有质的飞跃的;感觉agent的确需要人类引导漏洞挖掘方向,因为直接丢 ...
GPT-5.5和opus 4.8对挖洞行为很容易触发告警,很难做全自动漏挖的对比实验,我平时挖洞是opus 4.6+自己写的Harness+人机交互,专家的经验和判断能极大加速漏洞挖掘的效率,中低危和简单的高危已经是随便挖的状态了,现在大模型确实很强了
2026-6-16 20:23
0
雪    币: 237
能力值: ( LV1,RANK:0 )
在线值:
发帖
回帖
粉丝
22
2026-6-16 21:52
0
雪    币: 1200
活跃值: (1210)
能力值: ( LV2,RANK:10 )
在线值:
发帖
回帖
粉丝
23
6666666666666
2026-6-30 12:25
0
雪    币: 0
能力值: ( LV1,RANK:0 )
在线值:
发帖
回帖
粉丝
24
666
2026-7-3 15:15
0
雪    币: 5559
活跃值: (4567)
能力值: ( LV2,RANK:10 )
在线值:
发帖
回帖
粉丝
25
666
2026-7-6 08:34
0
游客
登录 | 注册 方可回帖
返回