大家好,这里是《老外看中国》系列。美国最高法院此前叫停了白宫依据紧急状态大范围加税的权限,但美国贸易代表随即表态,称这一裁决只废掉了其中一种征税渠道,并没有堵死所有施压路径,美方关税政策会保持连贯,301关税仍要继续。美国内部也出现裂痕。
有25个州联手起诉美国政府,矛头直指特朗普政府援引的301关税,认为所谓的强迫劳动调查根本站不住脚,是一场骗局。
这些州愤而起诉,是因为301制裁的冲击并不只落在被制裁国家身上,也影响到美国本土产业和各州的经济活动,大家自然会想方设法推动这类恶法被废除。因此25个州出手并不意外。
![]()
特朗普力推的对等关税本就被认为难以持续,如今再叠加这些301条款,更像是搬起石头砸自己的脚。眼下特朗普既要应对国内反弹,也要承受国际压力。
科技战线上的变化同样值得关注。近来中国大模型接连亮相,华为、阿里巴巴纷纷入场。先看华为的盘古。
这款开源的OpenPangu大模型在7月30日发布,参数规模为550亿。作为对比,此前讨论的Claude 3参数达到2.8万亿,两者不在一个量级。
![]()
当前大模型能用较低算力跑出好效果,靠的是算法上引入的“混合专家”机制。也就是说,虽然模型有几千亿参数,但每次只需调用其中一部分来解决问题。
![]()
盘古每次大约只激活180亿参数,相当于只用到约4%,其余96%可以休息,所需算力和成本自然降低。盘古还有两个“第一”。
它的训练用的是华为自研的昇腾NPU,而不是英伟达或其他品牌;从芯片到训练框架、模型算法乃至智能体平台,几乎全部自研。更关键的是,盘古是专门为华为鸿蒙系统打造的大模型,未来会把AI整合进鸿蒙生态,华为很可能也在布局AI手机。
它的定位已经不再是对标GPT那类通用模型,而是服务于自家系统。再看阿里巴巴的通义千问,计划在8月3日发布。
![]()
它的参数规模高达2.4万亿,量级相当可观,与GPT系列接近,甚至超过美国Llama大模型的参数。它单次推理激活的参数为950亿,用950亿除以2.4万亿,同样只需约4%的参数就能执行任务,其余96%可以休息,对算力的需求并不高。
阿里的目标与华为不同,它要把通义千问接入自家全部办公软件,打造覆盖各类办公系统的AI智能体——未来进入办公室所用的设备和工具,可能都是阿里的AI。通义千问在全球也很受欢迎。
在开源平台Hugging Face上,其下载量已超过10亿次,位居世界第一。加上DeepSeek新版本到来,中国的开源大模型正给美国那些封闭的专有模型带来不小冲击。
![]()
这两款大模型都是开源的,需要就能直接下载,各家也有各自打法:有的主攻高性价比、走最便宜路线,有的则瞄准顶级专业模型,定价更高,供专业人士使用。价格战同样激烈。
DeepSeek以极低成本搅动全球AI市场,美国的AI评级机构称其成本还不到Cloud 5的1%。随后OpenAI宣布降价80%,这被称为一条“杀线”,意思是要活下来,就得既有相当性能、又足够便宜。
![]()
从实际使用量看,在最新一周的API调用量排行里,DeepSeek位居第一,此前领先的小米被DeepSeek反超退居第二,腾讯等紧随其后。腾讯的元宝、字节跳动的豆包这类非专有模型也在加紧发力。
照这样的势头,美国曾经自认稳操胜券的技术战,正面临全面崩塌的局面——几乎每一款中国大模型,都能与美国正面较量,而且都是开源的。技术上被步步紧逼,贸易上又遭25个州起诉,特朗普政府内外交困,却仍试图延续301关税稳住施压节奏。
这是本期《老外看中国》,咱们下期见。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.