AI基础设施与模型层
聚合该赛道关键人物一手判断,值得关注的趋势与信号
- 看时间
- 英伟达发布Vera Rubin平台进展:CoreWeave测试显示单位功耗Token吞吐提升10倍
- 看时间,跨年
- 这是未发布趋势的支撑事件
- 8月25日消息,华为常务董事、产品投资评审委员会主任、终端BG董事长余承东在微博上表示:“全新三折叠,即将登场!9月7日14:30,HarmonyOS 7 | HUAWEI Mate XT 2及全场景新品发布会,敬请期待”。
- 华为余承东:9月7日发布全新三折叠
AI时代软件行业正从SaaS走向“结果即服务”(Outcome as a Service),客户只为最终解决的问题付费,商业模式需重新设计。
支撑:#长上下文与Agent普及,将使显存、KV Cache、存储和互连成为独立的竞争层
模型和开发工具日益普及,复制变得容易。核心竞争力转向对客户的理解、真实应用场景、稳定交付体系、独特数据以及渠道能力,而非仅仅调用模型或写代码。
支撑:#推理场景下,单芯片峰值算力将不再是衡量中国算力公司的首要指标
Dan Koe的“三种人”分类因忽视代际更替时间和地理隔离,将结构性问题简化为性格测试,误导了真实应对策略。
支撑:#长上下文与Agent普及,将使显存、KV Cache、存储和互连成为独立的竞争层
低密度城市缺乏对手、同行和纠错机会,个体意志难以转化为能力。
削弱:#长上下文与Agent普及,将使显存、KV Cache、存储和互连成为独立的竞争层
创业机会在于激活“沉睡需求”,而非简单加AI创业机会在于激活“沉睡需求”,而非简单加AI
削弱:#长上下文与Agent普及,将使显存、KV Cache、存储和互连成为独立的竞争层
通过GPU直接管理网卡通信消除CPU调度开销,属于集群层Token吞吐的系统级优化
支撑:#推理场景下,单芯片峰值算力将不再是衡量中国算力公司的首要指标
Anthropic从2021年成立起,就一直拿安全和可控性来“自命不凡”。公司在可解释性、红队测试(red teaming)、风险评估上大力投入,也因此长期被硅谷加速派嘲讽为“末日主义者”。
支撑:#长上下文与Agent普及,将使显存、KV Cache、存储和互连成为独立的竞争层
在AI PC端,AMD、英特尔、英伟达等芯片巨头加速布局。1月,AMD推出面向Windows 11 AI PC的锐龙AI 400、锐龙AI PRO 400处理器,算力最高可达60 TOPS,可在本地运行大模型。
削弱:#长上下文与Agent普及,将使显存、KV Cache、存储和互连成为独立的竞争层
该芯片内存带宽达1.22TB/s,为传统手机16倍,直接体现内存带宽的显著优化
支撑:#长上下文与Agent普及,将使显存、KV Cache、存储和互连成为独立的竞争层


