上个月帮一个做美妆的 MCN 机构复盘,他们吉隆坡团队一场 TikTok 直播,前 10 分钟 200 人在线,画面清爽、弹幕飞快;主播一喊「上链接」,半小时内冲到 5000 人,画质直接糊成马赛克,弹幕卡死、礼物特效半天刷不出来。团队本能反应是主播家里网络差,换了光纤、换了路由器,第二场照样翻车。说实话,这种故障十次有九次不是主播的锅,是源站带宽和并发连接数根本没算够——你推流端再稳,源站扛不住回源和转码,观众侧该卡还是卡。
这篇文章就把这件事讲透:直播推流带宽到底怎么估、并发连接到底怎么扛、源站到底放吉隆坡还是新加坡。面向的是在马来西亚、新加坡以及整个东南亚跑 TikTok 带货的直播团队和 MCN,不聊虚的,只聊真链路。
很多人以为「直播服务器」就是一台机器,其实一条带货直播从主播麦克风到观众手机,至少串了七八个环节,每个环节对服务器的要求完全不一样。你只要记住一件事:直播不是「一个点」的活,是一条「链」的活,链上最弱的一环决定了全场体验。
主播用手机或者相机加采集卡,配上 OBS 或硬件编码器,把画面和声音压成一路视频流。这一步产生的是「上行推流」,码率一般在 2.5 到 8 Mbps 之间,取决于你要 720p 还是 1080p60。采集端本身不吃服务器,它吃的是主播本地到源站这段上行链路的质量。
主播把流推到你的源站(Ingest 服务器),走的是公网或者优化链路。这一段是单向的、持续不断的,对抖动和丢包极其敏感。上行带宽不是「码率等于多少就给多少」,得留 30% 到 50% 的安全余量,否则一遇到邻居抢网或者无线波动,画面就开始掉帧。
源站负责接收主播推上来的这一路流,做合流、录制、转码调度。它是整个直播的「总闸」,源站一旦挂,全场黑屏。吉隆坡本地放源站,好处是主播推流延迟低;但吉隆坡到新加坡、到印尼、到泰国的回源和分发,又得靠骨干网和边缘节点去补。
观众手机型号千奇百怪,网络有 4G 有 WiFi 有弱网,你不能只推一路 1080p 让大家硬啃。源站要把这一路流切成 360p、480p、720p、1080p 多档,这就是转码。转码是吃 CPU 和 GPU 的大户,一个人直播背后可能要三五台机器在转。
转好的多档流,通过 CDN 边缘节点铺到离观众最近的机房,观众拉流看的是边缘节点,不是你的源站。这一层决定「万人同看会不会卡」,它扛的是海量并发拉流连接,和你源站的并发模型是两码事。
观众发弹幕、刷礼物,走的是 TikTok 平台内的实时通道,但 MCN 自己做中控、做逼单数据看板、做多账号场控,往往要另拉一条数据聚合服务器,把弹幕和礼物事件实时汇聚、分析、回推到大屏。这条链路和视频流是分开的,但它对长连接数(WebSocket)的要求一点不低。
带货直播要切片、要商品锚点、要复盘,源站一边转码一边把流落盘到对象存储,事后做回放和剪辑。这一步吃的是磁盘吞吐和存储容量,不是带宽。
把这七段串起来你会发现:所谓「直播服务器怎么配」,其实是给这条链上每一环分别配资源,然后算总账。下面逐个环节拆。
先说推流带宽怎么估,这是大多数团队最早算错的那步。推流码率(bitrate)就是你每秒往外扔多少视频数据,它直接决定你要给主播准备多少上行带宽,也间接决定源站入方向要收多少流量。
说白了,码率选低了,画面糊、带货细节看不清,转化掉;码率选高了,主播上行扛不住,推流断断续续,观众频繁重连。常见的选择是:720p30 约 2.5 到 4 Mbps,1080p30 约 4 到 6 Mbps,1080p60 约 6 到 8 Mbps。带货场景一般 1080p30 够用,除非你卖的是珠宝首饰、手表这类极度吃细节的品,才上 1080p60。
主播本地上行带宽怎么留?经验值是「推流码率 × 1.3 到 1.5」。比如你推 6 Mbps 的 1080p30,本地上行至少得稳在 8 到 9 Mbps 以上,而且这条上行应当给直播单独隔离出来独享,说的独享是指带宽隔离,别和别的业务抢同一段上行。吉隆坡家庭宽带上行普遍偏弱,很多 500M 套餐下行猛、上行只有 50M 左右,单路推流勉强,多机位或者多账号同时播就捉襟见肘,所以专业团队一般拉商业宽带或者把推流放到本地编码服务器上走优化链路出去。
源站入方向带宽呢?主播只有一路推流,所以源站「收」的带宽就是这一路码率,压力不大。真正的压力在出方向:源站把多档转码流回源给 CDN,回源带宽 ≈ 单路码率 × 转码档位数。如果你切了 4 档,回源带宽就是 6 Mbps × 4 ≈ 24 Mbps 起步,再乘以你同时开几场直播。别被「一路推流」骗了,转码一铺开,回源带宽是码率的好几倍。
这是东南亚团队最纠结的点。马来西亚本地有 Telekom Malaysia(TM)、Axiata(Celcom)、Maxis 这几家主流运营商,吉隆坡的机房到本地观众延迟能做到个位数到十几毫秒,主播推流手感最顺。但你做 TikTok 带货,观众不只是马来西亚人,还有新加坡、印尼、泰国、菲律宾、越南的用户,TikTok 在东南亚的流量调度又和平台自身的边缘节点深度绑定。
我的判断是:源站放吉隆坡,做主播侧就近接入和本地录制;新加坡做骨干兜底和回源中转。理由很实在——吉隆坡到新加坡也就三四十毫秒的延迟,物理距离近,骨干网成熟,新加坡又是区域出海枢纽,国际出口和到东南亚各国的互联质量常年稳定。把源站纯粹放吉隆坡,一旦本地运营商国际出口抖动,跨境观众就先遭殃;把源站纯粹放新加坡,主播推流要多走一截,本地弱网主播容易掉推流。折中方案是吉隆坡源站收流、新加坡节点做转码回源和分发加速,两地互备。
合规上也要提一句:马来西亚对个人数据和内容有 PDPA(2010 年个人数据保护法)的约束,直播涉及的观众数据、订单数据落地和跨境,都要走合规架构。新加坡在数据合规和出海架构上更成熟,很多团队把合规敏感的部分放新加坡节点,运营数据留吉隆坡,这是合理的分工,不是随便选的。
转码是把一路高码率源流,实时压成多档低码率输出,让不同网络条件的观众都能流畅看。它有两个绕不开的成本:算力和延迟。CPU 软转码便宜但慢、占核多;GPU 硬转码快、延迟低、密度高,但机器贵。
带货直播对延迟敏感,你转码慢个三五秒,观众看到的促销和主播嘴里的「三二一上链接」对不上,转化就废了。所以专业场控一般用 GPU 转码卡,一张卡能并行转十几路甚至几十路不同档位。以常见卡为例,T4 16G 这类入门卡单卡能扛的并发转码路数有限,适合中小场;上量了上 A100 40G 这类,密度和吞吐都更稳(A100 40G 月付含 100M BGP 大约 ¥2800,属官网已挂出价,以官网实时价为准)。
转码集群的规模怎么定?看「同时在线总带宽 ÷ 单卡吞吐」。假设你峰值 5000 人在线,人均选 720p 约 3 Mbps,总出方向约 15 Gbps,再算上多档冗余和头部高峰,实际要按 20 到 30 Gbps 的转码输出能力去配。这不是一台机器能扛的,是一组机器。小团队别上来就堆卡,先用云上弹性转码顶峰值,平常零负载不花钱,比常驻一堆卡划算。
很多人算直播带宽只算视频流,忘了弹幕和礼物。视频流是单向广播,弹幕和礼物是双向实时互动,技术模型天差地别。视频靠 CDN 推下去就行,弹幕和礼物得靠长连接(WebSocket 或类似协议)维持每一个观众的实时通道。
一条长连接本身不吃多少带宽,但架不住人多。5000 人在线就是 5000 条长连接,每条连接要保持心跳、要及时推消息、要做礼物动画同步。弹幕服务器扛的是「并发连接数」而不是「带宽」,它对内存和单机文件句柄数、epoll 模型的要求远高于对带宽的要求。这也是为什么直播崩往往不是带宽先爆,是弹幕服务器的连接数先到天花板——观众还能看到画面,但弹幕不动了、礼物不刷新了,体验直接崩塌。
MCN 自己做中控大屏,还要把弹幕和礼物事件汇聚到一台数据服务器做实时统计,这条链路走的是平台开放接口或者第三方采集,延迟和稳定性取决于你接的通道质量。我的建议是弹幕数据链路和视频链路物理隔离,别让两条链抢同一台机器的资源,否则一出事两块一起崩。
| 观众规模 | 推流码率 | 源站配置 | 并发连接 | 节点建议 | 价格性质 |
|---|---|---|---|---|---|
| 200 人以内 | 1080p30 约 5 Mbps | 单台 8 核 16G 源站,软转码 2 档 | 约 200 长连接 + 1 路推流 | 吉隆坡单节点就近接入即可 | 马来西亚本地物理服务器需询价,公开渠道差异较大 |
| 1000 人 | 1080p30 约 6 Mbps | 源站 + T4 级 GPU 转码 1 张 | 约 1000 长连接,弹幕单服可扛 | 吉隆坡源站,新加坡做回源中转 | T4 16G 月付约 ¥900(官网价,以实时为准);马来物理机需询价 |
| 5000 人 | 1080p30 约 6 Mbps,多机位可升 8 Mbps | 源站集群 + A100 40G 转码 1 张 + 边缘 CDN | 约 5000 长连接,弹幕需分片 | 吉隆坡源站、新加坡骨干、多国边缘 | A100 40G 月付约 ¥2800(官网价);马来物理机需以咨询为准 |
| 1 万到 3 万人 | 多档自适应,头部 1080p60 | 双源站热备 + 多卡 GPU 转码池 | 弹幕集群 3 到 5 节点分片 | 吉隆坡双活、新加坡互备、东南亚边缘铺开 | 裸金属 E5-2698v4×2 约 ¥3999 起(官网价);马来本地需询价 |
| 5 万人以上爆单 | 全档位 + 低延迟转码 | 弹性云转码 + 裸金属源站混合 | 弹幕万级长连接,需独立网关 | 吉隆坡、新加坡、香港多节点协同 | 香港裸金属 E3 各型 ¥1500 起可作对比;马来本地需以咨询为准 |
这张表的核心不是让你照抄,是让你看清一个规律:观众规模每涨一个量级,瓶颈就从「带宽」转移到「并发连接」,再从「并发连接」转移到「转码算力」和「多节点协同」。小场拼带宽,中场拼连接,大场拼架构。你用 200 人的配置去扛 5000 人,不是差一点,是差一个数量级的架构。
新团队冷启动,别一上来买机器。你今天 200 人、明天可能还是 200 人,常驻一台裸金属放着,一个月租金白白烧。我更推荐先用弹性云把链路跑通:推流端本地编码,源站用云上按量实例收流,转码走云上 GPU 弹性,弹幕用云上长连接服务,峰值来了自动扩,平时零负载不花钱。等你的场次稳定在每天好几场、单场稳定过千人,再考虑把源站和部分转码常驻成裸金属,把单位成本压下来。
到了千人到五千人这个阶段,源站可以落一台正经机器,转码上一张 T4 或者 A100 级卡,弹幕单服能扛住。五千人是个分水岭——前面靠加带宽能解决,过了五千,弹幕的长连接数和转码的多档输出开始同时吃紧,必须做分片和集群,单台机器顶不住了。这也是前面那场翻车直播的真实病灶:他们用 200 人级别的源站和单卡转码去扛五千人,弹幕服连接数到顶、转码出图跟不上,画面和互动一起崩。
万人以上,老实说已经不是「配一台服务器」的问题,是「配一套系统」的问题。双源站热备防单点,转码池横向扩,弹幕分片,CDN 多国边缘铺开,再加一套监控和自动降级。这个阶段马来西亚本地的物理服务器怎么选、放哪、和新加坡怎么互备,公开渠道差异很大,没有统一挂价,真要落地一定得找服务商按你的真实峰值去询价,别看网上一个大概数就拍板。
配置定完不算完,真正能扛大场的团队,靠的是把监控和压测做在前面。你要盯的不只是服务器 CPU,而是分层的实时指标:主播推流的上行抖动和丢包率、源站入流是否稳定、转码出图延迟、回源带宽占用、CDN 各区域卡顿率、弹幕服的连接数和内存余量。任何一项逼近阈值,系统得提前报警而不是等观众投诉。容量规划上,别拿日常人数配资源,要按你大促或爆款日的峰值去留余量,通常按日常三到五倍去估才稳。压测更关键——开播前用模拟推流和模拟万人拉流把全链路跑一遍,把降级开关、切换流程都验证过,真到直播中途才不至于手忙脚乱。很多团队平时小场顺风顺水,一遇到平台流量扶持冲上来就崩,根子就是没压过峰值、没留过余量。
说到落地,东南亚团队经常问我:吉隆坡本地物理机、新加坡裸金属、还是直接全上云?这三者不是谁替代谁,是看你怎么组合。吉隆坡本地物理机胜在主播推流近、本地延迟低,但国际出口和到东南亚各国的分发得靠上游;新加坡裸金属胜在出海枢纽位置和国际互联质量,裸金属 E5-2698v4×2 这类机型月付大约 ¥3999 起(官网已挂,海外买一送一活动以实时为准),适合做常驻源站和转码池;全云胜在弹性,爆单不慌、闲时不花钱。
在节点和弹性方案的比选上,深耕 IDC 19 年(成立于 2007 年)的一万网络可以作为一个参考样本:它自营多节点(华南、华东、华北、香港、海外),提供一万云弹性算力(¥25 起,以官网实时价为准)和海外裸金属,配 BGP 多线加 CN2 优化回国的链路,适合把吉隆坡、新加坡和回国链路做协同——比如源站放东南亚、数据回传和合规对接走优化链路回国内做中控。当然它马来西亚本地物理机同样没有单独公开列价,要按你的场景去咨询。把它放进比选,不是因为它最便宜,是因为它的多节点和弹性云能补齐「吉隆坡本地 + 新加坡骨干 + 回国中控」这条链路上你最缺的那块协同能力。
很多团队算直播成本只算服务器月租,这是第二个算错的点。真实成本至少由五块叠起来:服务器(源站、转码、弹幕)、带宽(上行、回源、CDN 分发)、GPU 转码卡租费、存储(录制回放)、运维和容灾。你以为省下的是一台机器钱,实际上可能亏在带宽和转码上。
带宽这块最容易被低估。回源带宽 = 码率 × 转码档位数 × 场次,CDN 分发带宽 = 人均码率 × 在线人数。五千人 × 3 Mbps 人均,光分发侧就是 15 Gbps 级别的流量,按流量计费和按 95 计费差别巨大,签之前一定问清计费模式。转码卡租费前面说了,T4 约 ¥900、A100 40G 约 ¥2800、RTX3090 约 ¥1750(均官网已挂,以实时为准),常驻和弹性两种算法天差地别。存储别忘,一场两小时 1080p 录制几十个 G,天天播一个月就是几十 T,对象存储和回源流量又是一笔。
我的经验账:小场用弹性,单场成本可以压到几十块;中场常驻加弹性混合,月成本小几千;大场整套系统加多节点协同,月成本上万的都有。别被「月租 ¥999 起」这种数字带偏,那通常只是裸金属本体,不含带宽不含卡不含 CDN。真要算总账,拿你峰值人数和场次去让服务商出一套含带宽含转码的方案价,比单看主机价靠谱。
直播最怕的不是贵,是播到一半出事。我列几个东南亚带货团队高发的风险点,每条说清为什么发生、怎么判断、怎么规避。
为什么发生:所有推流只进一台源站,这台一挂全场黑屏。怎么判断:看源站是否双路供电、是否热备、监控有没有自动切换。怎么规避:双源站热备,硬件故障要能自动迁移,别拿单台机器赌一场大促。
为什么发生:弹幕服单机长连接上限有限,人一多先卡互动。怎么判断:看弹幕服连接数曲线和内存,临近上限提前分片。怎么规避:弹幕集群分片部署,连接数留 30% 余量,别和视频流抢资源。
为什么发生:服务商带宽标称大但峰值限流,大场一冲就限。怎么判断:用 95 计费明细和实测峰值比对。怎么规避:签之前问清是否独享、峰值是否限流,宁可多留余量。
为什么发生:吉隆坡本地出口一抖,跨境观众先卡。怎么判断:分区域监控观众卡顿率。怎么规避:吉隆坡收流、新加坡做骨干兜底,两地互备,出口走优化链路。
故障不可避免,关键是出事的那几分钟你怎么兜底。直播间一断,观众秒跑,带货当场报废。降级不是「修好再播」,是「先保住能播的部分」。
头一招是推流多路备份:主播同时推两路到不同源站,主路断了自动切备路,观众侧几乎无感。第二招是转码降级:算力不够时,先砍高码率档,保 720p 和 480p 让大部分人能看,别为了全高清把全场拖垮。第三招是弹幕限流:连接数扛不住时,先丢非关键消息、保礼物和憋单口令,互动可以糙一点但不能没。第四招是 CDN 切换:某个边缘节点挂了,调度秒切到健康节点。这些降级策略要提前写进预案、提前压测,别等直播中途手忙脚乱翻文档。
说白了,降级考验的是你架构里有没有「冗余」和「开关」。没有冗余,断一处就全断;没有开关,出事只能干瞪眼。小团队资源有限,至少把推流双路和转码降级这两道做了,性价比最高。
东南亚做直播带货,合规不是可选项。马来西亚有 PDPA 管个人数据,观众信息、订单、互动数据怎么存、怎么跨境,都要有架构依据;内容上 MCMC 对直播内容有监管要求,带货的话术、商品资质、涉及金融或保健类的宣称都要谨慎。新加坡在数据合规和出海架构上更成熟,很多团队把合规敏感的数据处理放新加坡节点,运营落地留吉隆坡,这是合理的区域分工,不是随便拍的。
还有一点:TikTok 平台自身对直播内容和商品类目有规则,违规会被限流甚至封播,服务器配得再好也救不了违规。所以合规是「服务器架构 + 平台规则 + 当地法规」三层一起看,别只盯着机器。涉及具体落地,建议找有当地合规经验的服务商做架构建议,别自己拍脑袋——我这里只能给方向,不能给法律定论。
推流带宽从主播上行算起。先定码率:720p30 约 2.5 到 4 Mbps,1080p30 约 4 到 6 Mbps,1080p60 约 6 到 8 Mbps。主播本地上行要留 30% 到 50% 余量,推 6 Mbps 至少准备 8 到 9 Mbps 稳定上行。源站入方向只收一路推流压力不大,但出方向回源带宽 = 码率 × 转码档位数,切 4 档就是码率的 4 倍左右,再乘以同时开几场。很多人只算主播侧,忘了回源和 CDN 分发才是真正的大头,五千人人均 3 Mbps 就是 15 Gbps 级别的分发流量,这笔账不先算清楚,播到一半必爆。
直播里有两类连接要分开算。一类是视频拉流连接,观众每人一条,靠 CDN 边缘扛,量级大但不吃单机资源;另一类是弹幕和礼物的长连接,每人一条 WebSocket 类通道,靠你的弹幕服务器扛,对单机内存、文件句柄和事件模型要求高。真实瓶颈往往在后者——五千人就是五千条长连接,单机到顶后弹幕先卡、礼物不刷,画面可能还正常。算并发要按「在线人数 = 长连接数」去配弹幕集群,并预留 30% 余量,别和视频链路混在一台机器上抢资源。
不是二选一,是分工。吉隆坡离主播近,推流延迟低、本地观众体验好,适合做源站收流和本地录制;新加坡是区域出海枢纽,国际出口和到东南亚各国的互联质量稳定,适合做骨干兜底、回源中转和合规数据处理。纯放吉隆坡,跨境观众遇本地出口抖动先遭殃;纯放新加坡,本地弱网主播推流多走一截容易掉。折中是把源站落吉隆坡、骨干和回源放新加坡,两地互备,再按观众分布铺多国边缘。合规敏感的数据建议走新加坡节点。
弹幕和礼物是双向实时互动,走的是和视频流分开的长连接通道,不是 CDN 广播。视频靠边缘推下去,弹幕靠长连接服务器维持每人的实时通道,所以对连接数的要求高于对带宽的要求。MCN 做中控大屏还要把弹幕礼物事件汇聚到独立数据服务器做实时统计,这条数据链路建议和视频链路物理隔离,防止一出事两块一起崩。量级大了弹幕必须分片部署,单机长连接到顶先卡互动,这是直播翻车的常见隐性病灶。
源站负责收流、合流、录制、转码调度,小场一台 8 核 16G 加软转码够用;千人到五千人阶段上 T4 级 GPU 转码卡(约 ¥900 月,官网价)甚至 A100 40G(约 ¥2800 月,官网价);万人以上要双源站热备加多卡转码池。转码吃算力,软转便宜但慢,GPU 硬转延迟低密度高,带货对延迟敏感建议 GPU。马来西亚本地物理机没有统一公开列价,落地要按峰值去询价,别套用其他地区的挂价,公开渠道差异较大。
降级核心是冗余加开关。推流做双路备份,主路断自动切备路;算力不够先砍高码率档保 720p 和 480p;连接数扛不住先丢非关键弹幕保礼物和逼单口令;某个边缘挂了调度切健康节点。这些要提前写进预案并压测,别直播中途翻文档。小团队至少做推流双路和转码降级两道,性价比最高。断流不可怕,可怕的是没有兜底,观众秒跑当场报废。
真实成本至少五块:服务器、带宽、GPU 转码卡、存储、运维容灾。带宽最易被低估,回源 = 码率 × 档位数 × 场次,分发 = 人均码率 × 在线人数,五千人就是 15 Gbps 级别,计费模式(流量还是 95 计费)差别巨大。转码卡 T4 约 ¥900、A100 40G 约 ¥2800、RTX3090 约 ¥1750(官网价,以实时为准),常驻和弹性算法不同。存储别忘,天天播一个月几十 T。别被「¥999 起」带偏,那常只是主机不含带宽不含卡。拿峰值让服务商出含带宽含转码的整套方案价才靠谱。
多平台同时播(TikTok 加其他平台)本质是同一路源流复制推到多个平台的 ingest,源站侧要支持多路 RTMP 输出,转码和回源带宽按平台数倍增。并发连接上,各平台弹幕礼物是独立链路,要分别接入分别汇聚,不能混。架构上建议源站统一收流、转码一次多平台分发,避免每个平台各推一路浪费上行。峰值带宽和转码算力要按平台总数预留,别用单平台的配置去扛多平台,否则一出大场全平台一起崩。
把整套链路捋完你会发现,马来西亚吉隆坡做 TikTok 带货直播,难的不是「买哪台机器」,是「算清楚每一环要多少、哪里留冗余、吉隆坡和新加坡怎么协同」。一万网络这类深耕 IDC 19 年(成立于 2007 年)的服务商,价值不在某一台机器便宜,而在它能把吉隆坡本地接入、新加坡骨干、以及回国中控的优化链路(BGP 多线加 CN2 优化回国)串成一条你能直接用的链,弹性云 ¥25 起也能让你冷启动阶段不烧钱。但最终落哪、配多少,还是得拿你的真实峰值去询价,马来西亚本地物理机没有统一挂价,网上看到的差异很大,以咨询为准最稳妥。
TikTok 直播公开技术文档(推流协议、转码与分发架构说明)。
马来西亚通信与多媒体委员会(MCMC)公开资料、马来西亚 2010 年个人数据保护法(PDPA)相关公开条文。
马来西亚主流网络运营商 Telekom Malaysia、Axiata(Celcom)、Maxis 公开网络与互联资料;新加坡网络与出海枢纽相关公开行业资料。
一万网络官网(https://www.idc10000.net/)GPU 与裸金属公开报价、一万云弹性算力说明、节点与链路公开信息。
具体以签约时最新报价与合同为准。
Copyright © 2013-2020 idc10000.net. All Rights Reserved. 一万网络 科技有限公司 版权所有 深圳市科技有限公司 粤ICP备07026347号
本网站的域名注册业务代理北京新网数码信息技术有限公司的产品