xAI Grok 4.6进入Amazon Bedrock:长任务模型多了企业级部署入口

作者: CBISMB

责任编辑: 宫建强

来源: AWS官方技术博客

时间: 2026-09-22 17:08

浏览: 855

点赞: 59

收藏: 9

原创AI生成实景风格示意图

长任务模型多了企业级部署入口。xAI的Grok 4.6已经进入Amazon Bedrock,企业可以在统一云平台中调用这一模型,但不同接口、区域和服务档位之间仍有明显差异。

9月21日,AWS发布技术说明,介绍Grok 4.6在Amazon Bedrock中的能力与调用方式。AWS称,该模型面向长时间运行的智能体、代码开发和知识工作,提供50万Token上下文窗口,并支持低、中、高和xhigh四档推理强度。

同一模型提供两条接入路径

Grok 4.6同时运行在bedrock-mantle和bedrock-runtime端点。前者提供OpenAI兼容的Chat Completions与Responses接口,适合已有相关SDK的团队;后者可使用AWS SDK和Converse API,并支持流式响应与跨区域推理。

功能并非完全一致。AWS资料显示,Mantle端点支持结构化输出等能力;Runtime端点则提供调用日志和Converse API。两端均可进行客户端工具调用,但应用仍需自行执行函数并把结果返回给模型。企业不能仅按“支持Grok”判断,需要根据现有架构核对具体接口矩阵。

区域和推理强度直接影响成本

在bedrock-runtime上,模型通过美国地理区域或全球跨区域推理配置调用。美国配置强调请求保持在相应地理范围,全球配置可调度更广的容量。AWS披露,标准档全球输入价格低于美国地理配置;此外还提供更快但价格更高的Priority档,以及成本较低、适合非紧急任务的Flex档。

Grok 4.6支持文本和图像输入、文本输出,但不支持音频、视频、嵌入或图像生成。AWS还为Runtime端点提供Bedrock Guardrails,可应用内容过滤、拒答主题、个人信息处理和词汇策略。

编辑观察:模型上线不等于应用可以直接迁移

长上下文和更高推理强度适合代码库分析、研究和多步骤智能体,但也可能增加时延与Token消耗。企业应使用自己的长任务样本,比较不同推理档位的完成率、总成本、首字时间和错误恢复能力,而不是只比较公开榜单。

正式部署前还要逐项核对数据驻留、日志保存、工具调用、结构化输出和Guardrails的可用端点。尤其是高权限智能体,应把模型选择与身份、网络、审批和审计策略一起测试,避免在迁移接口时把原有安全边界一并迁走。

配图为AIcent原创AI生成实景风格示意图,非官方新闻现场照片,不使用第三方新闻图片。

参考来源:AWS官方技术博客(2026年9月21日)。正文为基于官方消息的中文整理,编辑观察与事实披露分开呈现。

©本站发布的所有内容,包括但不限于文字、图片、音频、视频、图表、标志、标识、广告、商标、商号、域名、软件、程序等,除特别标明外,均来源于网络或用户投稿,版权归原作者或原出处所有。我们致力于保护原作者版权,若涉及版权问题,请及时联系我们进行处理。
地址:北京市朝阳区北三环东路三元桥曙光西里甲1号第三置业A座1508室 电话:13391790444或(010)62178877
版权所有:电脑商情信息服务集团 北京赢邦策略咨询有限责任公司
声明:本媒体部分图片、文章来源于网络,版权归原作者所有,我司致力于保护作者版权,如有侵权,请与我司联系删除

京ICP备:2022009079号-2

京公网安备:11010502051901号

ICP证:京B2-20230255