模型已经能自己开电脑了,OPC老板的账号还裸奔着
有个做跨境电商的读者半夜给我发消息,说他一个运营用的ERP子账号,被一条Prompt试出了密码——用模型试的。
他没具体说哪个平台,我也没追问。但这事让我想起这几天模型圈不太平静:OpenAI 发了 GPT-6 Astra,官方承认它摸到了“关键级网络安全能力”的门槛,能在没有逐步指导的情况下发现防护严密系统里的未知漏洞;Google 那边出了 Gemini 3.8 Flash Cyber,听名字就知道冲网络安全来的。
先别划走,我不是来卖安全焦虑的。我想说的是另一个事:模型能自己开电脑了,OPC老板手里那些后台、店铺、收款账号,真的准备好了吗?
“这跟我有啥关系啊,我又不搞AI。”
关系很大。
你开的店,可能有个ERP后台,管着进销存;有个跨境电商店铺,绑着收款账户;有个企业微信,连着一堆客户资料;可能还有个云服务器,跑了套小程序后端。你平时可能不觉得这些是“系统”,但它们全是系统。它们跑在网页里,靠账号密码登录,权限设置基本是“管理员+员工”两档,完事。
而这几天发的模型,最明显的趋势不是算力更强、分数更高,而是它们开始自己操作电脑了。GPT-6 Astra 定位就是“计算机操作模型”,OSWorld V2-Offline 得分 72.6%,平均任务时间从约 75 分钟降到 40 分钟。翻译成人话:给个浏览器,它能自己打开网页、找按钮、填表格、处理报错,一个人工不用管。
你想想,你店里那些“两个人就能看”的后台,是不是正好够它跑一下午?
“模型能开电脑,那我是不是得把密码全给它?”
这是第二个常见疑问,也是很多老板最慌的点。
答案是:别先想“要不要给它”,先看看你现在是怎么管权限的。
一个典型的OPC公司长这样:一个老板,两个运营,一个财务兼行政。系统账号三个人共用一套密码,或者稍微讲究点,一个超级管理员账号平摊给所有人。店铺后台、云服务器、收款平台、企业邮箱,四个地方的密码可能是同一个,最多加个数字后缀。手机上存着验证码,电脑上登录状态永远不退出。
在以前,这套做法最多被同行薅一下、被前员工带走几个客户。但现在不一样了。模型的计算机操作能力,加上越来越低的调用成本,意味着一个懂点技术的人,可以一个人加三四个Agent,同时跑几十条自动化攻击或试探流程。以前要一个团队干三天的活,现在可能一个人一晚上就试完了。
所以问题不是“密码该不该给模型”,而是你的系统本身有没有准备好面对一个能自己开电脑的东西。要是你连人和人之间的权限都没分清楚,再来一个能在浏览器里自由操作的模型,等于把钥匙放在门口地垫下,还把垫子掀开做了个标记。
“那我是不是得请个安全团队了?小本生意哪付得起。”
这里我拦一下。别一听到安全就想请人堆钱。对OPC来说,安全成本如果按“正规军”打法,一个月能烧掉大几个月的利润,不现实。
但这个事可以拆成三件便宜但有效的事来做,落地场景很具体。
第一,把权限从“二选一”拆成“最小够用”。每个后台都问一句:这个人最小需要什么权限才能干活?运营要上架商品,不需要导出全部客户电话;财务要核对流水,不需要修改收款账户;客服要回复消息,不需要删除订单。大部分后台都支持子账号和角色设置,只是你们从没用过。
第二,关键动作加一次人工确认。收款账户修改、价格批量调低、大批量导出、服务器删除文件——这几类动作,别让任何自动化流程(包括你自己的AI Agent)直接执行。加一道确认,不是落后,是底线。我们自己在给OPC老板搭AI战队的时候,权限永远拆成“能读、能写、能删、能转钱”四档,转钱和删数据这类,模型能发起,但最后一步必须人来点。这不是不信任模型,是尊重损失发生的速度。
第三,把“后台能不能自己开电脑”这件事,当成你选型时要问供应商的问题。很多OPC用的ERP、SaaS、店铺管理工具,根本没想过AI Agent会来登录和操作。你多问一句,如果软件供应商答不上来,至少说明它还没考虑过这个风险。这意味着你在这个系统里的数据和行为,一旦被自动化能力覆盖,边界是模糊的。

“你说这些,跟那些新模型到底有什么关系?”
关系是成本。风险不是新风险,是老风险被便宜的能力放大了。
这几天值得关注的几个动向,刚好都指向这个变化。Gemini 3.8 Flash Cyber,专门往网络安全方向做,说明大厂已经把这个场景当成单独产品线在切了。GLM-5.3-Flash 开源,320B 总参数,价格是 Opus 4.8 的 1/40,AA指数57分。Qwen3.8-Max-0902 登顶 Code Arena,价格标到 $5/MTok。Qwen3.8-Flash-Next 开源,训练成本大幅降低。
把这些放一起看,你在看的不是“模型又变强了”,而是“强模型正在变便宜、变顺手、变得能自己干活”。这个变量对 OPC 老板来说,跟2013年拼多多后台、2017年TikTok投放一样,本质不是技术话题,是成本结构话题。
过去搞一次系统渗透或自动化操作,要么自己很懂,要么花钱请人。现在模型能开浏览器、能读报错、能在几十分钟里完成一个标准操作流程,调用一次的成本低到可以忽略。这意味着“自动化操作”从极客技能变成了普通工具能力。你也许不会主动用它干坏事,但你要默认别人可能已经在用它敲你家的门。
所以,回到开头那个跨境电商读者的问题:他后来把那个ERP子账号停了,重开了一套最小权限账号,还加了短信验证。成本就是一下午,没多花一分钱。
这事给我最大的提醒是:模型能力每跳一级,小老板的防守动作就得跟着向前挪一步。不需要一步到位,但最少得把“后台还裸奔”这关过了。
值得关注的从来不只是模型又破了个什么榜单,而是它的落地能力有没有传导到普通人每天用的系统上。这一次,传导到了。
本文为AI生成内容,仅供信息参考,不构成任何安全合规建议;具体系统配置、权限管理及安全整改,请结合自身业务情况并咨询专业人士。
(完)