AI基础设施与模型层

聚合该赛道关键人物一手判断,值得关注的趋势与信号

重要信号 Top 3
01中科曙光发布scaleFabric Token加速技术体系
02支付宝推出AI钱包智能体及三大“AI收”,智能体代买5个月增7倍
03全球首款 6nm 3D 晶圆级堆叠先进封装,小米玄戒 O100 实现 330TPS 超高端侧推理速度
一手判断
查看全部
李某
李某企业家
草稿状态草稿状态草稿状态草稿状态草稿状态草稿状态草稿状态草稿状态草稿状
关键判断
01标题1
02标题2
03标题3
信号流
AI 原生产品
头部城市拿走了七成份额,但上榜城市从9个增至16个,说明单点突破可能。在已有明确头部的赛道中做第十七名,意味着没有生态,而非“暂时落后”。

AI时代软件行业正从SaaS走向“结果即服务”(Outcome as a Service),客户只为最终解决的问题付费,商业模式需重新设计。

支撑:#长上下文与Agent普及,将使显存、KV Cache、存储和互连成为独立的竞争层

16人正在追踪
AI 原生产品
测试决定成败的不是个体努力强度123,而是日常能接触到的AI从业者密度。测试决定成败的不是个体努。湾区AI公司租下湾区租赁总量三成的写字楼;低密度城市缺乏对手、同行和纠错机会,个体意志难以转化为能力。

模型和开发工具日益普及,复制变得容易。核心竞争力转向对客户的理解、真实应用场景、稳定交付体系、独特数据以及渠道能力,而非仅仅调用模型或写代码。

支撑:#推理场景下,单芯片峰值算力将不再是衡量中国算力公司的首要指标

AI 原生产品
AI让“小公司挑战大公司”第一次具有结构性可能

Dan Koe的“三种人”分类因忽视代际更替时间和地理隔离,将结构性问题简化为性格测试,误导了真实应对策略。

支撑:#长上下文与Agent普及,将使显存、KV Cache、存储和互连成为独立的竞争层

16人正在追踪
AI 原生产品
AI正在激活大量过去无法成立的“沉睡需求”

低密度城市缺乏对手、同行和纠错机会,个体意志难以转化为能力。

削弱:#长上下文与Agent普及,将使显存、KV Cache、存储和互连成为独立的竞争层

16人正在追踪
AI 原生产品
AI越强,单纯的技术壁垒反而可能越弱

创业机会在于激活“沉睡需求”,而非简单加AI创业机会在于激活“沉睡需求”,而非简单加AI

削弱:#长上下文与Agent普及,将使显存、KV Cache、存储和互连成为独立的竞争层

16人正在追踪
AI 原生产品
中科曙光发布scaleFabric Token加速技术体系

通过GPU直接管理网卡通信消除CPU调度开销,属于集群层Token吞吐的系统级优化

支撑:#推理场景下,单芯片峰值算力将不再是衡量中国算力公司的首要指标

AI 原生产品
阿莫代伊和Anthropic:想当规则裁判的安全“卫道士”

Anthropic从2021年成立起,就一直拿安全和可控性来“自命不凡”。公司在可解释性、红队测试(red teaming)、风险评估上大力投入,也因此长期被硅谷加速派嘲讽为“末日主义者”。

支撑:#长上下文与Agent普及,将使显存、KV Cache、存储和互连成为独立的竞争层

16人正在追踪
AI 原生产品
Microduck搭载的并非英伟达、AMD或高通的高端芯片,而是一颗瑞芯微于2020年开发的中端SoC RK3566。

在AI PC端,AMD、英特尔、英伟达等芯片巨头加速布局。1月,AMD推出面向Windows 11 AI PC的锐龙AI 400、锐龙AI PRO 400处理器,算力最高可达60 TOPS,可在本地运行大模型。

削弱:#长上下文与Agent普及,将使显存、KV Cache、存储和互连成为独立的竞争层

16人正在追踪
AI 原生产品
全球首款 6nm 3D 晶圆级堆叠先进封装,小米玄戒 O100 实现 330TPS 超高端侧推理速度

该芯片内存带宽达1.22TB/s,为传统手机16倍,直接体现内存带宽的显著优化

支撑:#长上下文与Agent普及,将使显存、KV Cache、存储和互连成为独立的竞争层

16人正在追踪
加载中…