
{{aisd}}
AI生成 免责声明
当地时间10月8日,谷歌云发布Gemini Agent,将其定位为面向企业工作的通用智能代理。用户只需在统一提示框中提出目标,Agent便可规划任务、调用工具、连接企业业务系统,并将结果交付到文档、邮箱和开发环境中。
谷歌强调,该产品能够根据任务选择不同模型,并提供成本控制、权限管理和安全审计能力。AI竞争从回答问题、生成内容,进一步延伸至直接执行工作任务的趋势愈发明显。
与近期受到关注的个人AI Agent不同,Gemini Agent的核心战场是企业办公。它可以连接Gmail、Drive、Docs、Sheets、Calendar等谷歌办公产品,也支持接入外部企业系统。
谷歌希望将分散在不同软件中的信息、工具和工作流程整合起来,让AI不仅协助员工完成单项任务,还能承担项目协调、数据分析等工作角色。

从竞争维度来看,Gemini Agent更直接的对手并非主要面向个人消费者的Meta Muse或OpenAI Dots,而是微软Microsoft 365 Copilot,以及国内以豆包办公、千问办公为代表的AI办公产品,它们争夺的都是用户的工作入口。
国内厂商也在沿着类似方向推进。字节跳动持续强化豆包的复杂推理和多步骤任务执行能力,豆包工作今日宣布推出创作画布功能,主要针对复杂创作任务。阿里巴巴将千问模型能力与钉钉及办公工具结合。
相比单纯的聊天机器人,这类产品的竞争重点正在转向能否理解复杂需求、处理文件和数据、调用外部工具,并交付可直接使用的成果。不过,各家产品的功能范围、企业集成深度和实际执行能力目前仍有差异。
微软是另一重要竞争者。Microsoft 365 Copilot拥有Office、Teams及企业软件生态,能够将AI嵌入用户原有的办公流程。
谷歌与微软的竞争不仅是模型能力的比拼,也是办公软件入口、企业数据连接、用户习惯和企业服务体系的竞争。对企业客户而言,Agent能否接入现有系统、遵循权限规则、记录操作过程,并以可控成本稳定完成任务,比单次回答的质量更重要。
谷歌在模型迭代和爆款产品上虽处被动追赶,但在企业Agent赛道并非毫无积累。今年4月,公司已推出Gemini Enterprise Agent Platform,为企业提供Agent的构建、编排、部署和治理能力。10月发布的GeminiAgent进一步把这些能力推向员工日常使用的统一入口。前者更偏向企业构建和管理Agent的基础平台,后者则强调员工直接交付工作目标、由Agent执行并返回成果。

与此同时,个人Agent也在快速发展。Meta于9月推出Muse,探索由AI处理购物、预约、邮件等日常事务;OpenAI于9月发布Dots,强调持续运行、连接应用并逐步适应用户偏好;创业公司Instinct则尝试通过短信或电话,让Agent代办账单、购物和行程安排。
无论面向企业还是个人,新一轮Agent产品都呈现出相同变化:AI从生成答案转向完成目标。系统需要理解意图、拆解步骤、调用工具、保留上下文,并在执行失败时调整方案。模型能力仍是基础,但产品能否形成竞争优势,还取决于软件生态、工具连接、执行可靠性和持续运行成本。
Agent的自主执行能力越强,安全与治理的重要性也越突出。个人Agent可能因误解指令而发送错误信息或进行非预期操作,企业Agent则可能接触客户数据、源代码和财务系统。权限隔离、人工确认、操作审计和运行环境安全,将直接影响企业是否愿意把真实工作交给AI。
谷歌此次发布,不只是增加了一款AI办公产品,而是进一步将模型、办公软件、企业数据和Agent治理能力整合为工作平台。对于谷歌、微软以及国内办公AI厂商而言,下一阶段的竞争将不只是谁的模型更强,而是谁能让AI在真实业务中更可靠、更安全地完成任务。
OpenAI试图利用ChatGPT庞大的用户和开发者基础,把Agent进一步嵌入工作流。
头部大厂正在把Agent直接嵌入庞大的用户和应用生态。
用户授权的边界需要从“我同意使用AI”升级为“我清楚AI正在替我做什么”。
腾讯WorkBuddy的智能硬件合作方包括Plaud、Rokid、影石、科大讯飞、安克、猛玛、京东京造等。
AI办公场景仍需依靠质量稳定与企业付费意愿的成熟。