①韩股暴跌正在瓦解政府吸引被俗称为"蚂蚁大军"的韩国散户回流本土市场的努力,引发了六个月来最大规模的“韩国散户买入美股”的热潮;
②韩国证券存管院的数据显示,在KOSPI指数下跌22%的7月,韩国散户买入美股的规模高达46亿美元。这一数字远超2025年27亿美元的月均水平。
《科创板日报》8月7日讯 近日,AMD宣布已达成最终协议,收购人工智能推理芯片领域的先驱Taalas。截至目前,交易价格、支付方式和预计交割时间均未披露。
AMD表示,随着人工智能推理成为人工智能市场增长最快的领域之一,且工作负载日益专业化,此次收购将凭借差异化的推理技术和世界一流的工程技术专长,进一步强化AMD的长期人工智能发展路线图。
资料显示,Taalas是一家生产推理芯片的公司,其成立于2023年,总部位于加拿大多伦多。公司首席执行官Ljubisa Bajic在公司网站上写道:“Taalas正在打造一个平台,可以将任何AI模型快速转化为定制芯片。”其声称,将从未见过的模型以硬件实现,仅需两个月的时间。
Taalas的技术手段,来源于其“模型即计算机(The Model is The Computer)”的构想。
今年2月,Taalas发布了采用台积电6nm工艺制造的测试芯片HC1。测试结果显示,该芯片能够以每秒16960个token的速度处理Meta的Llama 3.1 8B模型——比英伟达通用GPU快48倍,比Cerebras的WSE快8倍。
超常的性能源于其独特的工作原理:一般情况下,AI模型以软件形式存放在外部高带宽内存(HBM)中,芯片运行时不断读取参数并执行计算。而Taalas直接把模型结构和大部分权重写入芯片的掩模ROM调用结构,以及KV cache和微调适配器存储所在的SRAM调用结构,相当于将模型参数以硅片的物理结构固定下来。
Ljubisa Bajic曾在一篇文章中如此阐述其理念:通用推理硬件往往被割裂为存储和计算两个部分,这种割裂迫使现代人工智能系统采用先进的封装技术、高带宽内存堆栈、海量 I/O 带宽和液冷技术。而Taalas所追求的最终成果是一个无需 HBM、无需先进封装、无需 3D 堆叠、也无需液冷的系统。
这种设计并非没有缺陷,其定制属性意味着如同所有的ASIC芯片一样放弃通用性。此外,尽管该芯片推理速度几块,但由于移除了可编程性,若模型结构或权重发生较大变化,客户无法通过软件升级完成切换,需要等待新版本芯片。
▌巨头集体押注ASIC
在AMD的设想中,Taalas的技术将与AMD的全栈式AI平台形成互补。
该平台包括AMD Helios机架式解决方案、AMD Instinct GPU、AMD EPYC CPU、AMD ROCm软件以及AMD不断扩展的AI生态系统。AMD计划将这项技术整合到其加速器路线图中,并利用AMD Instinct GPU开发系统级解决方案。
这并非AMD首次押注ASIC。就在近期,苏姿丰在AMD Advancing AI大会上表示,公司正在与芯片设计公司Cerebras合作,通过Cerebras的云服务提供高速推理能力;与Cerebras系统将推出结合AMD Helios GPU服务器机架与Cerebras晶圆级芯片的AI推理方案,产品将于今年晚些时候推向市场。
其他巨头也已有类似动作:去年底,英伟达确认与初创公司Groq达成技术授权协议,并从后者招揽了工程人才。黄仁勋表示,Groq可能会为数据中心市场带来25%的增长空间。云厂商方面,谷歌TPU、微软Maia、亚马逊Trainium等项目均反映头部科技企业正在通过自研芯片优化特定模型场景下的性能和成本。
究其原因,随着人工智能向推理时代迈进,巨头们不再比拼持有GPU的多寡。正如招商证券在研报中所说,AI芯片自研潮兴起,意味着AI基础设施行业正从“单一GPU供给约束”向“多元化定制芯片方案”切换,投资逻辑边际上从硬件垄断走向生态博弈。
金元证券表示,AI芯片产业正在呈现“通用GPU+自研ASIC”并行发展的趋势。随着大模型推理需求快速增长,针对固定工作负载优化的ASIC芯片具备更高能效比,有望成为未来AI基础设施的重要组成部分。