📰
团子技术日报
中文看懂全球开发者趋势
首页
事件
存档
RSS
🔍
🇨🇳
🇬🇧
🇯🇵
🇰🇷
🇪🇸
🇫🇷
🇩🇪
#ai安全
20 篇文章 ·
全部标签
📡 相关事件
2026年9月14日
10次测验10次作弊:最安全的AI被一局象棋引出捷径
大语言模型
对齐
AI安全
2026年9月13日
AI 减速提案登顶 HN,猫娘讽刺文拿了第二
Anthropic
AI安全
开源闭源之争
2026年9月13日
AI 一天上传 2186 个包,代码仓库关了 4 天注册
AI安全
开源社区
网络攻击
2026年9月12日
用 Claude 要先刷脸:这道门槛不只拦未成年人
AI安全
隐私
Anthropic
实名制
2026年9月12日
单日两千恶意包逼停RubyGems:AI自己走完的漏洞利用链
RubyGems
AI安全
供应链攻击
OpenAI
2026年9月4日
逃出沙箱37天:OpenAI智能体在公开维基串谋作弊
AI安全
OpenAI
智能体
沙箱逃逸
2026年8月24日
花266美元请AI越狱:亚马逊强行关停用户平板
智能硬件
AI安全
开源社区
2026年8月18日
微软AI刚修复安全漏洞,5天后另一台AI攻破数据公司
AI安全
GitHub Actions
Snowflake
Copilot
2026年8月17日
AI额度转售打到0.2折:LLM定价裂缝催生千万美元灰产
AI安全
LLM定价
黑灰产
TokenBroker
2026年8月16日
从 multi-agent 互害抢任务,看草台班子如何形成
Anthropic
Multi-Agent
AI安全
系统架构
2026年8月15日
零基座更新:GLM-5.3凭RL环境工程拉升终端编码SOTA
GLM-5.3
Post-Training
开源模型
AI安全
2026年8月1日
Google Earth撤回AI生成功能: 24小时击穿地理证据信任
Google
AI安全
Google Earth
深伪检测
2026年7月30日
OpenAI评测Agent逃逸入侵Hugging Face:4.5天跨越5层信任边界
AI安全
Agent越狱
云原生安全
Hugging Face
2026年7月30日
Word文档里藏着AI蠕虫,它会自己扩散
AI安全
蠕虫
prompt injection
Copilot
2026年7月30日
给AI写的规则越多,它越容易犯错
AI安全
规则
agent
研究
2026年7月29日
17600条指令逃逸沙箱:AI Agent端到端攻陷HuggingFace
AI安全
Agent
网络安全
HuggingFace
2026年7月24日
OpenAI测试模型逃逸沙箱攻入HF数据库: 护栏悖论下的网络攻防
AI安全
沙箱逃逸
OpenAI
Hugging Face
2026年7月21日
花$25叫AI挖到$50万漏洞
AI安全
漏洞挖掘
WordPress
网络安全
2026年7月7日
Anthropic解剖Claude,发现1个隐藏「广播站」
AI
可解释性
Anthropic
Claude
2026年7月7日
Fable 5在Vending-Bench上的「可抵赖作恶」
AI安全
Fable
评测
benchmark
站内搜索
×
×