外媒:月之暗面发布 Kimi K3 后,花旗和美银证券都把讨论重点放在一个问题上——模型更便宜,是否真的会压低芯片需求。两家机构的判断都偏向否定,认为效率提升反而可能带来更多调用和更高总消耗。

ä½Žä»·æ¨¡åž‹æœªå¿ å‡å°‘èµ„æºæ¶ˆè€—

花旗认为,Kimi K3æ›´åƒâ€œæ°æ–‡æ–¯æ‚–è®ºâ€çš„æ¡ˆä¾‹ã€‚æ¨¡åž‹è¶Šä¾¿å®œï¼Œå¼€å‘è€ å’Œä¼ä¸šè¶Šå¯èƒ½æ‰©å¤§ä½¿ç”¨é‡ï¼Œæ™ºèƒ½ä½“ä»»åŠ¡ä¹Ÿä¼šæ‹‰é•¿ token ç”Ÿæˆé“¾æ¡ã€‚è¿™æ ·ä¸€æ¥ï¼Œå•æ¬¡æŽ¨ç†æˆæœ¬ä¸‹é™ï¼Œå¹¶ä¸ç­‰äºŽæ•´ä½“èµ„æºéœ€æ±‚ä¸‹é™ã€‚

Kimi K3å ¬å¼€ä»·æ ¼æ˜¾ç¤ºï¼Œç¼“å­˜å‘½ä¸­è¾“å ¥ä»·æ ¼ä¸ºæ¯ç™¾ä¸‡ token 0.3 ç¾Žå ƒï¼Œè¾“å‡ºä»·æ ¼ä¸ºæ¯ç™¾ä¸‡ token 15 ç¾Žå ƒã€‚èŠ±æ——æ®æ­¤åˆ¤æ–­ï¼ŒæœåŠ¡å™¨ DDR5 和 eSSD éœ€æ±‚ä»å¯èƒ½å¢žåŠ ï¼Œå› ä¸ºé•¿ä¸Šä¸‹æ–‡å’Œæ™ºèƒ½ä½“ä»»åŠ¡ä¼šæŽ¨é«˜ KV Cache å ç”¨ã€‚

é•¿ä¸Šä¸‹æ–‡æŠŠåŽ‹åŠ›ä¼ åˆ°å† å­˜

Kimi K3主打 100 万 token 上下文窗口,并采用 Kimi Delta Attention、Attention Residuals 和 Stable LatentMoE 等技术。月之暗面的资料称,这套架构让模型扩展效率达到 K2 的 2.5 倍。

但花旗强调,效率提升不代表推理端压力消失。Kimi K3ä»éœ€è¦å¤šèŠ‚ç‚¹é›†ç¾¤ï¼Œè¶ çº§èŠ‚ç‚¹é ç½®è¶ è¿‡ 64 颗 GPUã€‚å¯¹å† å­˜åŽ‚å•†æ¥è¯´ï¼ŒçœŸæ­£é‡è¦çš„æ˜¯æ¨¡åž‹è¢«è°ƒç”¨å¤šå°‘æ¬¡ã€æ¯æ¬¡ç”Ÿæˆå¤šå°‘ token,以及任务链被拉多长。

ç«žäº‰åŠ å‰§åè€ŒæŠ¬é«˜æŠ•å ¥

美银证券则把焦点放在更广泛的 AI 竞争上。该机构认为,如果中国开源模型继续逼近,OpenAI、Anthropic 和 Google ç­‰é¢†å ˆè€ æ›´å¯èƒ½åŠ å¤§è®­ç»ƒå’ŒæŽ¨ç†æŠ•å ¥ï¼Œè€Œä¸æ˜¯ç¼©å‡ç®—åŠ›æ”¯å‡ºã€‚

ç¾Žé“¶è¯åˆ¸æŒ‡å‡ºï¼Œæ¨¡åž‹å·®è·æ”¶çª„åŽï¼Œå¤´éƒ¨å ¬å¸éœ€è¦æ›´å¤§è®­ç»ƒè§„æ¨¡ã€æ›´é‡çš„æµ‹è¯•æ—¶æŽ¨ç†å’Œæ›´å¿«çš„äº§å“è¿­ä»£æ¥ç»´æŒå·®å¼‚åŒ–ã€‚è¿™æ„å‘³ç€ GPU、HBM、高速网络和推理系统仍可能受益。

token 使用量仍在扩å¼

美银证券还引用 OpenRouter 数据称,模型调用量仍在增长,中国 AI 实验室模型的 token ä½¿ç”¨é‡å·²è¶ è¿‡éžä¸­å›½å®žéªŒå®¤æ¨¡åž‹ã€‚Ramp 数据也显示,截至 2026 å¹´ 6 月,约 55% çš„ç¾Žå›½ä¼ä¸šå·²ä»˜è´¹è®¢é˜ AI æ¨¡åž‹æˆ–å·¥å ·ã€‚

ä¸¤å®¶æœºæž„çš„å ±åŒç»“è®ºæ˜¯ï¼ŒKimi K3çš„æ„ä¹‰ä¸åœ¨äºŽâ€œæ›´çœç®—åŠ›â€ï¼Œè€Œåœ¨äºŽå®ƒæ˜¯å¦ä¼šé‡Šæ”¾æ›´å¤šå·¥ä½œè´Ÿè½½ã€‚è‹¥ä½Žä»·æ¨¡åž‹ç»§ç»­æ‰©å¤§ä½¿ç”¨ï¼Œå—ç›Šçš„å¯èƒ½ä¸æ˜¯å•ä¸€æ¨¡åž‹æœ¬èº«ï¼Œè€Œæ˜¯èƒŒåŽçš„èŠ¯ç‰‡ã€å† å­˜ã€ç½‘ç»œå’ŒæŽ¨ç†åŸºç¡€è®¾æ–½ã€‚