昨晚文章篇幅有限,我们就提到了ChatGPT的新模式实现AGI水平了。什么是AGI?我们在当时写DeepSeek内部纪要的时候写过,这也是DeepSeek的目标,甚至为了尽快实现AGI,DS愿意暂时放掉多模态这一路线。简单说,AGI是指一种能够理解、学习、并应用于任何智力任务的人工智能,它的认知能力和综合智力水平与人类相当。而在AGI上面还有一个终极形态,叫ASI,超级人工智能。老黄在英伟达业绩会上,也提到了AGI时代到来。所以今天老黄很兴奋并爆了一个观点。GPT-6 Astra 这一代,训练用了大概 10万张 Grace Blackwell GPU,现在后面还有 40万张 GPU 要继续上线。ANI(如GPT-4)的训练已经需要数万张GPU卡,而迈向AGI需要的训练数据量和模型参数量将是现在的数百倍甚至上千倍。这要求GPU集群从“万卡”向“百万卡”级别扩张。极致算力和极低延迟互联都离不开光通信。老黄这句话,比高盛的研报更有说服力!另外今天海外在传,OpenAI的Astra 之后的下一代主模型(不是像 Astra 6.1 这样的小更新),将作为 AGI 发布。它将能够实时执行行动,包括玩实时游戏。其能力将超越 next token prediction ,具有类人的一般理解、在所有领域专家级别的表现,以及某种程度的递归自我改进能力。发布时间可能在11月中下旬。说真,科技真要改命,目前急需一轮新叙事,而AGI既有可能是那个导火线,接下来就关注下anthropic是不是跟进模型落地。
