脉向AI|当豆包手机遭遇“全网封杀“:GUI Agent是通向AGI的必经之路吗?

脉向AI|当豆包手机遭遇“全网封杀“:GUI Agent是通向AGI的必经之路吗?

💡 这是「脉向AI」的深度对话

✨ 只做一件事:邀请真正在AI一线的实践者,拆解影响千万职场人未来的真实变革

这是「脉向AI」的第一期。这个栏目是脉脉与「人民公园说AI」联手打造的思想实验室。我们坚持做一件看似简单却极有价值的事:邀请真正站在AI浪潮前沿的实践者,拆解那些影响千万职场人未来的真实变革。

不贩卖焦虑,不堆砌术语,而是让大家看到:

  • 🌐 这些技术变革背后的商业逻辑是什么?
  • 💼 它将如何重塑我们的工作方式?
  • 🧭 普通职场人该如何在这个浪潮中找准自己的定位?

本期,我们聚焦一个近期刷屏科技圈却又被大众忽视的话题:为什么从华为到小米,从OPPO到vivo,几乎所有国产手机厂商都在系统层面屏蔽了字节跳动的豆包AI手机功能?

💬 "表面上是商业竞争,实质是各方对'AI时代用户入口'控制权的争夺。这将直接影响未来3-5年每个人的工作方式与职业选择。"
—— 张和,本期嘉宾

👤 一、嘉宾张和:站在操作系统与AI融合前沿的战略操盘手

🎓 专业背景
✅ 前头部手机厂商OS战略规划负责人
✅ 12年操作系统与AI融合实战经验
✅ 主导3代AI原生操作系统战略落地
✅ 亲历从功能机到AI手机的完整转型周期

在深入本期话题前,让我们先认识这位不常在公众视野露面,却深刻影响着我们每天使用的手机体验的战略专家。

张和的职业生涯几乎与中国智能手机的崛起同步。2011年,当iPhone刚刚在中国掀起第一波智能机热潮时,他加入了一家头部国产手机厂商,从操作系统底层开发做起。2016年,AI开始进入公众视野,他敏锐地察觉到这将是手机行业的下一个转折点,主动转型至战略部门,专注于探索AI与操作系统的融合路径。

📱 关键战略节点(张和亲历):

  • 2018年:将AI能力引入系统级服务,如相机场景识别、电池智能管理
  • 2020年:推出首个基于用户行为预测的"智能助理"功能
  • 2022-2023年:规划"AI原生操作系统"路线图,将大模型能力深度整合到系统底层
💡 "很多人以为手机OS只是个'壳',实际上它决定着AI能力如何触达用户。就像今天的豆包手机事件,表面上是商业竞争,实质是各方对'AI时代用户入口'控制权的争夺。"
—— 张和

本期对话由「人民公园说AI」主理人小苏主持。他曾供职于国内一线AI实验室,现专注于大模型应用研究与科普,对技术与商业的交叉点有着独特的洞察力。


⚡ 二、豆包被"封杀":一场静悄悄的行业地震

📊 事件时间线

时间事件行业反应
2024年1月字节跳动高调推出"豆包AI手机"功能媒体广泛报道,用户期待高涨
2024年3月起各大手机厂商开始在系统层面限制豆包开发者社区出现兼容性报告激增
2024年4月豆包用户增长曲线出现断崖式下跌字节内部多个AI相关项目方向调整

这一系列动作并非公开宣布,而是通过系统更新、应用商店审核、权限限制等方式"静悄悄"地完成。业内对此有多种解读,而张和认为,这些解读都只看到了表象。

🔥 "真正的原因在于,GUI Agent正在挑战手机行业过去十年建立的权力结构——这不是防御字节,而是防御任何可能夺走这一战略节点的外部力量。"
—— 张和

🧠 三、核心观点一:GUI Agent是通向AGI的必经之路

💡 张和的关键洞察:
"GUI Agent不是手机上的一个'功能',而是通向通用人工智能(AGI)的关键环节,是终局的一部分。"

他解释道,当前大模型虽然在文本、图像生成上取得了突破,但距离真正的"通用智能"仍有巨大差距。而GUI Agent的独特价值在于,它能够理解人类意图,并通过操作系统界面直接执行任务,形成"感知-决策-行动"的闭环。

🌰 一个真实案例
当你对豆包说"帮我整理上个月的报销发票",它需要:
1️⃣ 理解你的意图
2️⃣ 访问相册和文件
3️⃣ 识别发票内容
4️⃣ 按财务规则整理
5️⃣ 生成标准报告

💡 "这个过程中,它不是在生成内容,而是在真实世界中完成任务。这种'行动能力',正是AGI的核心特征之一。"
—— 张和

🌍 为什么手机是最佳试验场

  • 全球有超过60亿智能手机用户
  • 每天产生海量真实交互数据
  • 这些数据包含人类在真实场景中的行为模式
  • 对AI而言,这是无法替代的训练资源

⚖️ 四、核心观点二:短期阵痛与长期博弈

🎯 张和的产业分析:
"豆包被屏蔽,是GUI Agent发展历程中必然经历的阵痛。短期压制会加速行业成熟,当所有玩家都意识到'全封闭'不可持续,妥协与开放将不可避免。"

📈 当前市场格局分析

🏆 大厂策略:筑墙自守

"头部手机厂商凭借庞大的用户基数和完整的生态链,选择建立自己的AI助手。他们不愿将用户习惯和交互数据交给第三方,尤其是在AI竞争的关键时期。这不仅是商业考量,更是技术路线的选择。"

🤝 小厂困境:被迫站队

"中小手机厂商面临更艰难的选择。他们缺乏足够的AI研发能力,又不敢得罪大厂供应链。最终的结果是,要么完全放弃AI战略,要么与某一大厂深度绑定,失去独立性。我称之为'被迫投降'。"

🔍 豆包的真实价值
"对于长尾应用场景,比如小众办公需求、特定行业工具,超级App往往无法兼顾。而像豆包这样的第三方AI,可以更灵活地填补这些空白。"

💎 关键洞察
"当超级App拥有足够强的谈判能力,它可以选择性地开放或关闭这些接口。这就是为什么我们看到,即使在被屏蔽后,豆包仍然能与某些厂商保持有限合作——这完全取决于商业利益的权衡。"


💬 五、主持人视角:巨头的闭环战略与普通人机会

🎙️ 小苏的观点:
"谷歌和阿里这样的企业拥有独特优势——他们同时掌握生态系统和大模型技术。对谷歌而言,Android是自己的,Gemini是自己的,完全可以构建一个从底层到应用的完整闭环。"

🔍 深度对比:巨头VS普通开发者

维度巨头(谷歌/阿里)普通开发者/企业
资源同时拥有生态+大模型通常只有一项优势
策略闭环自给自足寻找生态缝隙
机会定义标准,掌控入口解决长尾需求,做垂直领域的专家

小苏特别强调:

"对绝大多数企业和个人开发者而言,关键在于找到巨头生态无法覆盖的细分场景。一家外贸公司的单证处理,一个设计师的素材管理,这些长尾需求正是第三方AI的机会所在。"

张和补充:

"GUI Agent的价值不在于替代所有应用,而在于连接那些被割裂的数字孤岛。当大厂们争夺入口时,聪明的开发者已经在思考:如何利用这一技术,解决具体场景中的真实问题。"

💼 六、为什么这期对话对职场人至关重要?

🚀 张和预测的四大职业变革:

1️⃣ 交互设计师的角色进化

🎨 "不再只是设计按钮和页面,而是设计AI与人协作的工作流。懂AI逻辑的设计师将成为稀缺人才。"

2️⃣ 产品经理能力重构

📊 "传统的产品规划方法将失效。如何定义一个由AI驱动的功能边界?如何平衡自动化与用户控制权?这需要全新的思维框架。"

3️⃣ 开发者的技能升级

💻 "纯前端或后端开发的价值将下降,而能理解系统级AI集成的全栈工程师将获得溢价。特别是熟悉操作系统原理的人才,将迎来黄金期。"

4️⃣ 普通办公族的效率革命

⏱️ "当GUI Agent成熟,80%的日常办公操作将通过自然语言完成。那些率先掌握'AI指令设计'能力的人,将在同龄人中脱颖而出。"

小苏的补充洞察:

💡 "这场变革将加速'技术民主化'。当一个普通销售助理能通过简单的语音指令,完成过去需要IT支持才能做到的数据分析,组织结构将被重新定义。"

🌉 七、脉脉与「脉向AI」:连接前沿思考与职场成长

✨ 2亿+职场人的共同选择
脉脉:中国领先的职场人社交与成长平台,覆盖超10万家企业

「脉向AI」栏目的诞生,源于我们对用户需求的深度观察。在脉脉社区,关于AI的讨论日益增多:有人焦虑"AI是否会取代我的工作",有人困惑"该学哪些AI技能",更多人希望了解"如何将AI真正用到工作中"。

🎯 我们的承诺
每期「脉向AI」,我们都将邀请:

  • 👥 亲历技术变革的一线实践者
  • 🧠 深谙产业逻辑的战略思考者
  • 💡 能将复杂技术转化为实用价值的内容创作者

🌟 你能获得

  • 🔍 看清技术变革的真正方向
  • 🚫 避免在错误赛道上过度投入
  • 🧭 找到适合自己的AI赋能路径

Read more

【无人机避障算法核心技术】:揭秘五种主流算法原理与实战应用场景

第一章:无人机避障算法概述 无人机避障算法是实现自主飞行的核心技术之一,其目标是在复杂环境中实时感知障碍物,并规划安全路径以避免碰撞。随着传感器技术和计算能力的提升,避障系统已从简单的距离检测发展为融合多源信息的智能决策体系。 避障系统的基本组成 典型的无人机避障系统包含以下关键模块: * 感知模块:利用激光雷达、超声波、立体视觉或RGB-D相机获取环境数据 * 数据处理模块:对原始传感器数据进行滤波、特征提取和障碍物识别 * 决策与规划模块:基于环境模型生成避障轨迹,常用算法包括A*、Dijkstra、RRT和动态窗口法(DWA) 常见避障算法对比 算法优点缺点适用场景A*路径最优,搜索效率高高维空间计算开销大静态环境全局规划DWA实时性强,适合动态避障局部最优风险室内低速飞行RRT*渐进最优,适应复杂空间收敛速度慢三维未知环境 基于深度学习的避障方法示例 近年来,端到端神经网络被用于直接从图像生成控制指令。以下是一个简化的行为克隆模型推理代码片段: import torch import torchvision.transforms as tran

AI绘画:解锁商业设计新宇宙(6/10)

AI绘画:解锁商业设计新宇宙(6/10)

1.AI 绘画:商业领域的潜力新星 近年来,AI 绘画技术以惊人的速度发展,从最初简单的图像生成,逐渐演变为能够创造出高度逼真、富有创意的艺术作品。随着深度学习算法的不断优化,AI 绘画工具如 Midjourney、Stable Diffusion 等的出现,更是让这一技术走进了大众的视野,引发了广泛的关注和讨论。这些工具不仅操作简便,而且能够在短时间内生成多种风格的绘画作品,大大降低了绘画创作的门槛。 AI 绘画在商业领域展现出了巨大的潜力。据相关数据显示,2021 年中国 AI 绘画市场规模仅为 0.1 亿元,而预计到 2026 年将激增至 154.66 亿元 ,年复合增长率高达 244.1%。这一迅猛的增长趋势,反映出 AI 绘画在商业应用中的广阔前景。越来越多的企业开始认识到 AI 绘画的价值,并将其应用到广告、插画、

Microi吾码:从零到服装ERP:低代码打造企业级系统的实战之旅

Microi吾码:从零到服装ERP:低代码打造企业级系统的实战之旅

个人主页:chian-ocean 文章专栏 从零到服装ERP:吾码平台打造企业级系统的实战之旅 关键词:吾码平台、低代码、服装ERP、多表关系、自动化、开发实例 引言 在传统的服装行业管理中,ERP系统已成为提高效率、降低成本、优化资源分配的核心工具。然而,开发一个功能全面、覆盖采购、库存、销售、财务等模块的ERP系统,往往需要投入大量时间和人力资源。在吾码低代码平台的支持下,1人仅用1个月便完成了包含100+表的企业级服装ERP系统。本文将从项目概述、开发细节到关键代码段详细剖析整个开发过程,展示低代码技术的强大能力。 第一部分:项目概览 1.1 项目背景 * 项目需求: * 支持采购、库存、销售、客户管理、财务报表等多个模块。 * 包括100+数据表,涵盖复杂的业务逻辑与数据关联。 * 需实现流程自动化(如采购审批、库存提醒)。 * 开发目标: * 快速完成开发,并保证系统稳定性与扩展性。

无人机低空智能巡飞巡检平台:全域感知与智能决策的低空作业中枢

无人机低空智能巡飞巡检平台:全域感知与智能决策的低空作业中枢

无人机低空智能巡飞巡检平台是融合无人机技术、AI 算法、5G/6G 通信、GIS 地理信息系统与物联网的一体化解决方案,通过 "空天地一体化" 协同作业,实现对 500 米以下低空空域目标的无人化、自动化、智能化巡检管理,彻底革新传统人工巡检模式,为能源、交通、市政、安防等多领域提供高效、安全、精准的巡检服务。 一、核心架构:端 - 边 - 云协同的三层体系 平台采用 "终端执行 - 边缘计算 - 云端管控" 的全栈架构,构建低空智能服务闭环: 终端层:工业级无人机(多旋翼 / 固定翼 / 复合翼)+ 智能机场(换电 / 充电式)