(万字长文)如何用Codex搭建亚马逊全自动选品工作流?
晚上11点,运营还在卖家精灵里翻关键词。
Excel里已经堆了300多个ASIN,一会儿看销量,一会儿查评论,一会儿计算FBA费用。看到一个产品数据不错,又要去1688找供应链、查尺寸、估头程,最后还要担心专利和退货。
忙了三个小时,老板问:“所以,哪个产品值得继续调研?”
运营回答:“这几个看起来还可以。”
问题就在这里。
数据查了很多,结论依然是“凭感觉”。
很多卖家听到Codex自动选品,第一反应是写一句提示词:帮我找10个适合亚马逊美国站的蓝海产品。
然后等AI报出产品名称。
我先把结论放前面:
真正能落地的Codex自动选品,不是让AI凭一段提示词替你决定卖什么,而是把数据采集、清洗、筛选、验证、评分、复核和报告做成一条自动运行的证据链。
Codex可以替你处理大量重复工作,但最后要不要开模、下单和压库存,仍然需要卖家承担商业判断。
AI能替你整理证据,替不了你承担库存。
一、先重新定义“全自动选品”
我理解的全自动,不是从头到尾没有人参与,而是下面这些动作能够按照固定规则重复执行:
自动获取市场、关键词和ASIN数据;
自动统一字段、单位和时间口径;
自动淘汰不符合硬性条件的产品;
自动计算利润与现金占用;
自动分析竞争、评论和关键词机会;
自动识别缺失数据与高风险项;
自动生成候选产品报告;
按固定周期重新检查市场变化;
在关键决策点暂停,交给负责人确认。
这条工作流可以简化为:
数据输入 → 数据清洗 → 硬性淘汰 → 多维评分 → 风险复核 → 候选名单 → 人工决策
全自动的是流程,不是责任。
二、Codex在这套系统里扮演什么角色?
Codex本质上是一个能够理解任务、操作文件、运行代码并调用外部工具的工作代理。
在选品场景中,它可以承担4类工作。
01
数据调度员
通过已经授权的MCP连接器、API、数据库或本地文件,Codex可以获取:
类目和关键词数据;
ASIN销量与销售额趋势;
价格、BSR和评论变化;
搜索量及关键词趋势;
竞品集中度;
FBA尺寸和费用;
供应商报价;
退货与评论文本;
团队历史选品数据。
但这里要说清楚:Codex不会自动拥有卖家平台、SellerSprite、SIF、Keepa或供应商系统的权限。
你需要先完成连接器授权、API配置,或者定期把CSV、Excel文件放进指定目录。
02
数据清洗员
不同工具的字段名称、单位和时间范围经常不同。
比如:
月销量和近30天销量不是完全相同的口径;
商品尺寸和包装尺寸不能混用;
售价、优惠后价格和历史成交价不是一回事;
搜索量、搜索排名和点击量代表不同含义;
毛利率和扣除广告后的贡献利润率不能混为一谈。
Codex可以按预设规则统一这些字段,并把无法对齐的数据标记出来。
03
分析执行员
Codex可以运行固定的筛选和评分逻辑,对几百个候选产品执行同一套标准。
它不会因为某个产品“看起来很新奇”就临时降低门槛,也不会因为运营喜欢某个产品就忽略评论壁垒。
04
报告生成员
分析结束后,Codex可以把结果整理成:
候选产品排行榜;
单个产品机会卡;
利润测算表;
关键词机会表;
竞品对比表;
风险清单;
待补数据清单;
继续调研与淘汰建议。
真正有价值的不是一份漂亮报告,而是每个结论都能追溯到来源、时间和计算过程。
三、搭建工作流前,先准备这5类输入
市场需求数据
至少包括:
核心关键词;
搜索量或搜索热度;
搜索趋势;
关键词季节性;
相关产品数量;
头部ASIN点击或转化集中度;
买家需求场景。
品牌卖家还可以结合Amazon Brand Analytics中的热门搜索词和搜索表现数据。
竞品数据
至少包括:
ASIN;
售价及价格历史;
销量与销售额趋势;
BSR及变化;
评分和评论数;
上架时间;
变体数量;
卖家与配送方式;
尺寸和重量;
优惠活动;
头部品牌及ASIN集中度。
供应链数据
包括:
采购报价;
最小起订量;
打样费;
包装成本;
产品尺寸和包装尺寸;
产品重量和包装重量;
生产周期;
头程费用;
质量控制要求;
可定制空间。
如果供应商数据没有进入系统,所谓“利润测算”大概率只是纸面利润。
成本与利润数据
至少计算:
单件贡献利润 = 售价 - 采购成本 - 头程 - 平台佣金 - FBA费用 - 仓储 - 促销 - 退货损耗 - 广告成本
选品阶段没有真实广告数据,可以使用保守情景、基准情景和乐观情景分别测算,但必须标注为假设。
不要把未扣广告和退货的毛利率,当成产品最终利润率。
风险数据
包括:
专利与商标;
产品认证;
材料和标签要求;
危险品风险;
儿童或食品接触风险;
易碎和高退货属性;
季节性;
侵权词;
变体复杂度;
供应链稳定性。
Codex可以整理和预警风险,但不能替代专业律师、检测机构或合规顾问给出最终结论。
四、用Codex搭建7层自动选品工作流
第一层:
定义选品任务书
不要一上来就让Codex找产品。
先把边界写清楚:
目标站点;
目标类目;
价格区间;
预算上限;
可接受尺寸;
目标利润;
供应链能力;
团队优势;
禁止进入的产品类型;
希望解决的买家需求。
例如:
帮助具备塑料和硅胶供应链的小团队,在亚马逊美国站Home & Kitchen中,寻找标准尺寸、非带电、非危险品、需求稳定且存在明确评论改进空间的候选产品。
如果这句话写不清楚,后面的自动化只会更快地跑偏。
第二层:
建立统一数据模型
市场范围:Amazon美国站 Home & Kitchen
分析层级:优先细分类目,再下钻核心关键词和ASIN
细分类目月销量:3,000–50,000件
细分类目月销售额:≥$100,000
过去12个月趋势:稳定或增长,排除明显季节性
头部商品集中度:Top 10销量占比≤40%
品牌集中度:Top 10品牌销量占比≤40%
卖家集中度:Top 10卖家销量占比≤40%
亚马逊自营销量占比:≤20%
近6个月新品数量:≥5个
近6个月新品成功数量:≥2个
核心关键词月搜索量:5,000–50,000
供需比:优先高于类目中位数
核心关键词前三页商品数:≤1,000
首页自然位平均评论数:≤500
首页至少3个商品评论数:≤200
新品进入首页所需评论数:≤100
关键词ABA点击集中度:≤50%
目标售价:$25–40
平均退货率:≤6%
成熟期广告费占比:≤20%
目标真实净利率:≥20%
标准尺寸、非易碎、非带电、非儿童、无需安装
包装重量:≤1kg
包装最长边:≤50cm
采购价:≤100元
Codex需要先知道每一列数据代表什么。
建议把数据统一成4张基础表:
markets:关键词和细分市场;
products:ASIN与商品表现;
costs:供应链和履约成本;
risks:合规、专利、退货和供应链风险。
每个字段同时记录:
字段名称;
数据来源;
数据日期;
原始单位;
是否为估算;
缺失时如何处理。
没有数据口径,自动化只是把错误更快地复制一遍。
第三层:
先做硬性淘汰
评分之前,先淘汰明确不适合团队的产品。
硬性条件可以包括:
无法达到团队设定的最低贡献利润;
产品尺寸超出物流能力;
涉及当前团队无法处理的认证;
专利或侵权风险未解决;
最小起订量超过资金承受范围;
季节性与备货周期不匹配;
供应商无法提供关键材料证明;
关键数据缺失,无法完成测算。
这里的阈值由卖家自己设定,不存在适合所有团队的统一数字。
一个资金充足、供应链成熟的团队能承受的产品,小团队未必能做。
第四层:
进行多维评分
通过硬性筛选后,再对候选产品评分。
下面是一套示例权重,不是亚马逊官方标准:
需求质量:25分;
竞争可进入性:20分;
利润与现金效率:25分;
供应链适配度:15分;
风险可控性:15分。
每个维度都要拆成可验证指标。
例如,“竞争可进入性”不能只看评论数,还要结合:
头部ASIN集中度;
头部品牌集中度;
新品进入情况;
评论壁垒;
变体壁垒;
价格竞争;
广告竞争;
产品差异化空间。
最后输出的不只是总分,还要保留每一项子分和扣分原因。
第五层
:从评论里寻找真实缺口
数据只能告诉你市场有没有机会,评论才能告诉你机会在哪里。
让Codex读取竞品评论后,可以按以下维度归类:
功能缺陷;
材料问题;
尺寸不适配;
安装困难;
清洁维护;
包装破损;
使用说明;
预期落差;
目标人群未被满足;
高频退货原因。
然后要求它区分:
偶发抱怨;
多个竞品共有的问题;
供应链能够解决的问题;
改进后会明显增加成本的问题;
无法通过产品设计解决的问题。
评论里出现抱怨,不等于存在商机。
如果买家希望产品更耐用,但改进后成本提高40%,市场又不接受涨价,这个“痛点”未必值得解决。
第六层:
执行反向审查
很多AI选品报告只会证明“为什么值得做”,这非常危险。
我一般会增加一个反向任务:
假设我们已经准备投入这个产品,请找出最可能导致项目失败的5个原因,并用数据判断哪些风险尚未被排除。
反向审查至少检查:
需求是否主要来自短期热点;
销量是否被少量品牌垄断;
新品增长是否来自低价或大额促销;
利润是否依赖不现实的广告假设;
退货是否可能吃掉利润;
供应链改进是否容易被复制;
产品是否存在隐性合规成本;
库存周转是否超出现金流承受能力。
一套只会推荐产品、不会淘汰产品的自动化工作流,没有真正的决策价值。
第七层:
设置人工审批门
以下动作不应该默认自动执行:
联系供应商并确认报价;
支付打样费;
确认专利与合规结论;
决定首批采购数量;
下采购订单;
提交认证材料;
批量修改线上Listing;
对外发送包含经营数据的报告。
Codex运行到这些节点时,应暂停并输出:
已确认事实;
尚未确认的数据;
当前建议;
最大风险;
需要负责人批准的动作。
成熟的自动化不是取消审批,而是让负责人只处理真正需要判断的部分。
五、一段可以直接使用的Codex任务模板
任务:Amazon美国站 Home & Kitchen 五款新品选品
一、目标
基于卖家精灵MCP的类目、关键词和ASIN数据,筛选5个不同细分类目的产品机会:
- 3款常青产品
- 2款季节产品
- 竞争策略:中等竞争,通过原创印刷和设计差异化切入
- 不得为了凑够5款而放宽硬性标准
- 若完全合格产品不足5款,返回实际合格数量及缺口原因
二、资金与经营目标
- 项目总预算:人民币50万元
- 单品总预算:人民币10万元
- 五款同时测试
- 单品最大亏损:人民币2万元
- 90天内日均销量低于2件:停止补货
- 6个月目标:月销≥300件
- 月贡献利润目标:≥人民币2万元
- 月贡献利润计算:
销售额-采购成本-头程/关税-Amazon销售佣金-FBA履约费用
- 真实经营净利率:≥20%
- 真实净利润需继续扣除广告、退货、仓储、促销及人工
- 成熟期广告费用率:≤20%
- 初筛人民币兑美元汇率使用7.2,并进行±5%敏感性分析
三、库存与供应链
- 采购地区:广东
- 首批每个Listing总库存≤300件
- 首发3–5个变体,共享300件库存
- Listing后续最多扩展至10个变体
- 首批货款建议≤3万元
- 单件采购价硬上限:200元;优先≤100元
- 打样至首次交货:≤90天
- 成熟期补货交期:≤30–45天
- 每款合规及检测预算:1万元
- 不得仅根据类目名称推断广东有供应链
- 没有供应商、报价、MOQ和交期证据时,标记“供应链待验证”
四、产品硬性限制
必须满足:
- FBA履约
- 包装重量≤1kg
- 包装最长边≤50cm
- 非易碎
- 非带电
- 非儿童用品
- 无复杂组装
- 允许简单墙钉、螺丝或胶贴安装
- 允许折叠或压缩包装
- 不得有明显印刷或材料气味
- 纺织品允许正常机洗,但不得要求熨烫或特殊护理
- 可使用纸、纺织品、塑料/PVC、薄木板/MDF、轻质金属
- 食品接触、长期皮肤接触、阻燃产品必须有适用检测资料
- 首批仅允许有检测支持的物理性能宣称,如防水、耐褪色、可清洗
- 排除抗菌、杀菌、治疗及预防疾病等受监管宣称
仅FBA,因此排除买家下单后上传照片、输入文字的按单定制产品;允许预先生产的原创图案、字母、身份、宠物、宗教或节日设计。
五、类目数据硬门槛
针对Home & Kitchen细分类目获取并统一单位:
- 月销量:3,000–50,000件
- 月销售额:≥$200,000
- 常青类目过去12个月趋势:稳定或增长
- 季节类目:最近年度旺季需求不低于上年同期,并有清晰重复周期
- Top 3商品销量占比:≤40%
- Top 10商品销量占比:≤65%
- Top 3品牌销量占比:≤40%
- Top 10品牌销量占比:≤65%
- Top 3卖家销量占比:≤40%
- Top 10卖家销量占比:≤65%
- Amazon自营销量占比:≤20%
- 最近6个月上架新品:≥3个
- 最近6个月成功新品:≥2个
- 主流售价:$25–80
- 平均退货率:≤8%
Amazon自营20%是本任务的自定义风险线,不作为Amazon官方规则。
成功新品定义:
- 上架≤180天
- 近30天销量≥100件
- 近30天销售额≥$3,000
- 评分≥4.2
- 评论数≤100
六、产品选择关键词门槛
每个候选类目下钻核心关键词:
- 月搜索量:1,000–50,000
- 供需比:高于本次候选词库中位数,且优先>1
- 竞争商品数:≤1,000
- 首页自然位平均评论数:≤500
- 首页至少存在3个评论数≤200的商品
- 成功新品进入首页时评论数:≤100
- ABA点击集中度:≤50%
- 同时输出ABA转化集中度
- PPC竞价/平均售价优先<5%
- 趋势稳定或增长
缺少搜索量、趋势、售价、竞争商品数或集中度时,不得判定完全合格。
七、新品推广关键词单独筛选
不要与产品选择门槛混合。针对最终候选的词库:
- 搜索量处于词库P40–P70
- SPR处于词库P40–P70
- 供需比>1
- ABA点击集中度<40%
- ABA转化集中度<40%
- 精准匹配建议竞价<$1.50
- 搜索趋势增长
- 预估ACOS<90%
预估ACOS公式:
ACOS = PPC竞价 ÷(平均售价 × 转化率)× 100%
转化率大于1时先除以100。缺少竞价、售价或转化率时,不得填0,标记“PPC/ACOS待验证”。最多输出20个推广关键词。
八、设计优势评分
对通过硬门槛的候选进行100分评分:
- 市场需求与趋势:20分
- 竞争可进入性:20分
- 新品成功验证:15分
- 关键词机会:15分
- 单位经济模型:15分
- 原创印刷/图案差异化:10分
- 广东供应链与运营可行性:5分
设计评分重点检查:
- 首页是否高度同质化
- 能否通过原创图案、文字排版、材质组合或套装形成差异
- 是否支持持续增加设计变体
- 是否适合小批量印刷
- 是否能共用现有印刷、包装和设计能力
- 是否存在个性化审美溢价
- 是否容易被低价复制
九、主题与知识产权
允许宠物、婚礼、新居、家庭身份、职业、宗教、政治、幽默及成人主题,但政治、宗教和成人主题必须增加品牌安全审查。
一律排除:
- 影视、动漫、游戏和球队IP
- 名人姓名或肖像
- 未授权艺术作品
- 可能受商标保护的口号
- 疑似专利或版权侵权设计
卖家精灵数据不能证明无侵权;未完成商标、专利和版权检索时标记“IP待验证”。
十、季节产品规则
- 最终选择2款季节产品
- 可考虑万圣节、感恩节、圣诞节、情人节或母亲节
- 根据执行日期自动选择仍有开发窗口的节日
- 预计入仓时间必须早于需求高峰至少60天
- 若交期不足,不得推荐该节日
- 旺季结束允许清仓亏损,但仍受单品最大亏损2万元限制
十一、输出要求
先给结论,再给证据。输出:
1. 数据范围、抓取日期、站点和数据缺失率
2. 类目筛选漏斗:总数、各规则淘汰数量、剩余数量
3. 通过初筛的前15个细分类目
4. 每个类目的核心关键词及代表ASIN
5. 最终5款候选:3款常青+2款季节
6. 每款候选必须包含:
- 类目及产品方向
- 月销量、月销售额、趋势
- 商品/品牌/卖家集中度
- Amazon自营占比
- 新品数量及成功新品数量
- 售价、评论壁垒、退货率
- 3–10个核心关键词
- 代表性新老ASIN
- 采购价、FBA费用和利润敏感性测算
- 原创设计切入方式
- 合规、侵权、退货和供应链风险
- 推荐首发变体及300件库存分配
- 90天验证指标和退出条件
每一项结果必须标记为:
- 完全合格
- 数据合格但运营待验证
- 数据不足
- 淘汰
任何缺失指标都不得自动视为通过。退货率、供应链、检测、专利或真实成本无法从MCP获得时,必须列出人工验证动作。


宠物品类交流群
家居品类交流群
母婴用品交流群
亚马逊运营干货包
TikTok运营干货包
跨境电商行业报告
跨境电商交流群
亚马逊卖家交流群
独立站卖家交流群



























