贝有科技

BEIYOO·AI 简报:智能体开始替你点网页,权限边界要先画出来

返回 AI 简报#3642026-08-27
BEIYOO·AI 简报:智能体开始替你点网页,权限边界要先画出来 封面图

Share

分享本期简报

手机端可调起系统分享;桌面端可复制链接或扫码后转发。

本期重点
  • Claude Cowork 内置浏览器上线:智能体可在独立侧栏完成网页阅读、点击和输入,浏览器执行能力正从插件走向产品默认能力。
  • 北京公布首例 AIGC 领域商业秘密行政处罚,内部 AI 商业软件、数据库和业务流程的权属与访问控制需要留下证据链。
  • Qwen 开源 Qwen3.8-Flash-Next,作为 Qwen4 架构的早期预览,继续以稀疏 MoE 和多模态能力降低推理门槛。
  • Google 推进 Gemini Live 与应用连接,语音入口正进一步连接邮件、日程和生产力任务;工作流边界比单点聊天能力更重要。
  • 英伟达与 AWS 的扩容消息持续拉高算力供给预期。对企业而言,模型选择不应脱离峰值、延迟、区域与退出成本。
  • 公益广告出现明显生成瑕疵后被撤下,再次说明面向公众的 AIGC 内容必须保留人工审核与发布前检查。

企业 AI 的下一轮难题,不是“模型能不能做”,而是“它被允许做到哪一步”。浏览器、邮箱、表单和内部系统一旦被智能体串起来,权限设计、人工确认、审计日志和资产归属就必须成为项目验收项。先把可执行权限切细,团队才敢把更多真实工作交给智能体。

Deep Read

今日深读

把浏览器交给智能体之前,先把权限交代清楚

Anthropic 为 Claude Cowork 的桌面端加入内置浏览器:智能体可以在侧栏自行打开网页、阅读、点击和填写表单。它与用户日常浏览器隔离,默认不读取现有标签页、书签和保存的密码;但若工作需要,用户仍可逐站导入登录态。智能体从“给答案”走到“替人操作”的门槛,正在显著降低。

这件事的关键不在于多了一个浏览器,而在于企业需要把“谁能操作什么”落实到系统设置。能读网页,不代表能提交订单;能填写表单,不代表能访问财务、客户或人事系统。浏览器隔离只是基础,真正要管理的是账号、授权范围、敏感操作确认和可追溯记录。

北京公布的首例 AIGC 商业秘密行政处罚也提供了另一面提醒:内部 AI 软件、数据库和工作流并不是“谁拷走都无所谓的工具”。当模型、插件、提示词、数据和自动化流程一起参与生产,企业需要像管理源代码一样定义资产边界、访问控制和离职交接,才能让智能体扩张不变成治理漏洞。

By The Numbers

数字看板

10 万元

北京市公布首例 AIGC 商业秘密行政处罚,对私自复制使用原单位 AI 商业软件的行为作出处罚;AI 软件与配套数据同样应纳入资产保护。

125B / 6B

Qwen3.8-Flash-Next 为 125B 参数的多模态 MoE 预览模型,每个 token 激活约 6B 参数,反映开源模型继续围绕推理效率做取舍。

$0.16 / $0.47

Qwen3.8-Flash 的生产版本公布每百万 input / output token 的价格。企业评估模型时,应把单价、上下文长度和工具调用一并计入成本。

Action Item

企业能抄的作业

给会操作网页的智能体做一次权限验收

  1. 1选一个正在试用的网页型智能体,列出它能访问的站点、账号、数据类型和可执行动作,区分“阅读”“填写”“提交”“下载”。
  2. 2为高风险动作补一条硬规则:涉及付款、发信、导出客户数据、修改线上配置时,必须二次确认并记录操作者、时间与结果。
  3. 3把内部模型、插件、提示词库、工作流和数据表纳入资产清单;为离职、外包与跨团队协作预设回收权限的流程。

News Briefing

今日快讯

Claude Cowork 内置浏览器上线:网页操作进入桌面侧栏

标签:智能体工作流 / 产品能力

Claude Cowork 在桌面应用中加入内置浏览器。遇到网页任务时,智能体可在侧栏自行浏览、阅读、点击和输入,无需额外安装扩展;该浏览器与用户日常浏览器隔离,默认不读取用户的标签页、书签和保存密码。

对企业而言,浏览器型智能体把“查信息”推进到“执行流程”。试点时应把站点白名单、账号权限、提交前确认和操作日志一并验收,而不是只看它能否完成演示任务。


北京公布首例 AIGC 商业秘密行政处罚案

标签:AI 治理 / 合规

北京市市场监督管理局通报,朝阳区市场监管局对携带、复制并使用原单位 AI 商业软件的行为作出 10 万元处罚。这是北京市首例 AIGC 领域商业秘密行政处罚,通报明确了未公开的 AIGC 商业软件可作为商业秘密受到保护。

模型之外,业务软件、数据表、提示词、插件配置和自动化流程都可能构成竞争资产。企业需要为这些资产留存权属、访问和交接证据,特别是核心员工与外部协作场景。


Qwen3.8-Flash-Next 开源,提前展示 Qwen4 架构方向

标签:开源模型 / 推理效率

Qwen 团队开放 Qwen3.8-Flash-Next 权重,将其定位为 Qwen4 架构的早期预览。这是一款多模态 MoE 模型,采用 125B 参数规模与高度稀疏的激活设计;生产版本 Qwen3.8-Flash 提供 1M 上下文和内置工具能力。

开源模型的比较不应只看榜单。企业在选型时应结合真实任务的并发、上下文、工具调用和部署约束,测量实际完成率与单位任务成本。


Google 升级 Gemini Live,语音入口继续连接应用工作流

标签:智能体工作流 / 生产力

Gemini Live 的更新进一步强化语音交互与 Google 应用协作,重点指向任务执行、跨应用连接和个性化服务。语音入口正在从问答界面变成调度工作流的前台。

企业不必急着复制所有入口形态。优先挑选规则明确、输入输出可验证的环节,例如会议纪要整理、服务工单分发或信息补全,再逐步连接更多系统。


Qwen 办公接入 Flash,办公智能体开始强调高频供给

标签:AI 应用 / 办公自动化

千问办公宣布上线 Qwen3.8-Flash,强调面向办公场景的智能体供给与任务执行。随着轻量模型能力提升,高频、低风险的文档处理和信息整理会更快落入日常工作流。

高频不等于可以无边界使用。建议先限定资料范围、输出格式与责任人,并为错误结果保留人工复核入口,避免“看似省时、实际返工”。


腾讯混元发布极低 bit 翻译模型,压缩推理成本

标签:模型部署 / 推理效率

腾讯混元发布极低 bit 翻译模型,报道显示模型体积可从 3.3GB 压缩到约 440MB,同时尽量保持翻译质量。更小的模型包意味着边缘部署、私有环境和弹性扩容有了更多选择。

若翻译、分类、摘要等任务已足够成熟,团队可以把“性能达标线”先写清,再评估低比特模型是否能降低部署成本与响应时间。


AWS 与英伟达扩容消息升温,算力预算仍要按业务测算

标签:算力基础设施 / 成本

AWS 与英伟达扩大 GPU 部署计划的消息,继续强化了市场对训练与推理需求的预期。无论供给如何扩容,企业采购算力或调用 API 时,真正影响预算的仍是业务峰值、上下文长度、重试率与模型路由策略。

建议把“每次调用单价”换算为“每个业务任务的交付成本”,再决定哪些任务使用高能力模型,哪些由轻量模型或规则流程承接。


OpenAI 前研究员重返 Google,人才流动仍围绕模型研发

标签:产业动态 / 人才

OpenAI 前研究员巴雷特·佐夫重返 Google、参与 Gemini 研发的消息,反映出前沿模型团队的人才竞争仍在继续。大厂之间的能力差距,不只体现在模型发布,也体现在研究、工程和产品协同效率。

对使用方而言,不必被单条人事新闻带着频繁换供应商。保留模型路由、评测集和数据接口的可迁移性,比押注单一厂商更稳妥。


公益广告因 AI 生成瑕疵撤下,发布审核不能缺席

标签:AIGC 内容 / 品牌风险

一则公益广告被发现人物肢体、场景物品存在明显生成异常后撤下,相关部门确认其中使用了 AI 生成内容。面向公众的素材即使不是核心业务系统,也会直接影响机构的专业感与可信度。

把 AIGC 放进品牌流程时,应明确事实核验、画面检查、版权确认和最终发布人的责任。AI 可以加快初稿,但不能替代最后一道编辑判断。


小鹏 Robotaxi 开启无人道路测试,具身智能仍需从受控场景验证

标签:具身智能 / 自动驾驶

小鹏 Robotaxi 开启无人道路测试并披露内测订单进展。自动驾驶与具身系统的共同点在于:模型能力只是起点,真正决定能否扩展的是受控场景中的安全冗余、异常处置与持续验证。

企业部署任何能影响现实业务的智能系统,都应先设置清晰的试点边界和退出机制,把不可逆操作留给经过验证的流程。

有类似的场景想推进?

先把目标、边界和验收方式聊清楚,再决定怎么开始。