如果算力不再需要钱,你最想验证哪个疯狂想法?不是“训练更大的模型”,而是那些你真心想知道答案、却没人舍得花算力去做的事:奇怪的架构、荒谬的上下文长度、上千个智能体、离谱的消融实验……
这里举 5 个例子:
1. 完全不使用注意力机制的模型,能走多远?
2. 把上下文撑到 1 亿 token,模型会涌现什么能力?
3. 让 1000 个智能体自由协作,能不能解决单个模型搞不定的任务?
4. 对同一套权重做 10 万次消融,哪个参数才是真正不可删的?
5. 用随机初始化的模型做推理,效果到底有多差?
当算力不再是约束,研究的方向就会从“稳妥”转向“疯狂”。你真正想测试的是什么?
在评论区写下你的想法,订阅本栏目,继续讨论这些没人敢做的实验。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.