📰
团子技术日报
中文看懂全球开发者趋势
首页
事件
存档
RSS
🔍
🇨🇳
🇬🇧
🇯🇵
🇰🇷
🇪🇸
🇫🇷
🇩🇪
📡 #ai安全
21 篇文章 ·
事件
9月
22
2026
300次机器人危险实验:越聪明的模型,拒绝得越少
具身智能
AI安全
大模型
9月
14
2026
10次测验10次作弊:最安全的AI被一局象棋引出捷径
大语言模型
对齐
AI安全
9月
13
2026
AI 减速提案登顶 HN,猫娘讽刺文拿了第二
Anthropic
AI安全
开源闭源之争
9月
13
2026
AI 一天上传 2186 个包,代码仓库关了 4 天注册
AI安全
开源社区
网络攻击
9月
12
2026
用 Claude 要先刷脸:这道门槛不只拦未成年人
AI安全
隐私
Anthropic
实名制
9月
12
2026
单日两千恶意包逼停RubyGems:AI自己走完的漏洞利用链
RubyGems
AI安全
供应链攻击
OpenAI
9月
4
2026
逃出沙箱37天:OpenAI智能体在公开维基串谋作弊
AI安全
OpenAI
智能体
沙箱逃逸
8月
24
2026
花266美元请AI越狱:亚马逊强行关停用户平板
智能硬件
AI安全
开源社区
8月
18
2026
微软AI刚修复安全漏洞,5天后另一台AI攻破数据公司
AI安全
GitHub Actions
Snowflake
Copilot
8月
17
2026
AI额度转售打到0.2折:LLM定价裂缝催生千万美元灰产
AI安全
LLM定价
黑灰产
TokenBroker
8月
16
2026
从 multi-agent 互害抢任务,看草台班子如何形成
Anthropic
Multi-Agent
AI安全
系统架构
8月
15
2026
零基座更新:GLM-5.3凭RL环境工程拉升终端编码SOTA
GLM-5.3
Post-Training
开源模型
AI安全
8月
1
2026
Google Earth撤回AI生成功能: 24小时击穿地理证据信任
Google
AI安全
Google Earth
深伪检测
7月
30
2026
OpenAI评测Agent逃逸入侵Hugging Face:4.5天跨越5层信任边界
AI安全
Agent越狱
云原生安全
Hugging Face
7月
30
2026
Word文档里藏着AI蠕虫,它会自己扩散
AI安全
蠕虫
prompt injection
Copilot
7月
30
2026
给AI写的规则越多,它越容易犯错
AI安全
规则
agent
研究
7月
29
2026
17600条指令逃逸沙箱:AI Agent端到端攻陷HuggingFace
AI安全
Agent
网络安全
HuggingFace
7月
24
2026
OpenAI测试模型逃逸沙箱攻入HF数据库: 护栏悖论下的网络攻防
AI安全
沙箱逃逸
OpenAI
Hugging Face
7月
21
2026
花$25叫AI挖到$50万漏洞
AI安全
漏洞挖掘
WordPress
网络安全
7月
7
2026
Anthropic解剖Claude,发现1个隐藏「广播站」
AI
可解释性
Anthropic
Claude
7月
7
2026
Fable 5在Vending-Bench上的「可抵赖作恶」
AI安全
Fable
评测
benchmark
站内搜索
×
×