8万亿,梁文锋也开始卷“超大”
摘要:DeepSeek也加入参数大竞赛了。据The Information报道,DeepSeek目前正在训练一个约2万亿参数的新模型;梁文锋还在近期一场投资者会议上表示,公司下一步计划继续把模型推到8万亿参数。放在一年前,8万亿还是个难以想
共 77 篇文章
摘要:DeepSeek也加入参数大竞赛了。据The Information报道,DeepSeek目前正在训练一个约2万亿参数的新模型;梁文锋还在近期一场投资者会议上表示,公司下一步计划继续把模型推到8万亿参数。放在一年前,8万亿还是个难以想
摘要:AMD近日发布了一份围绕第六代EPYC 9006“Venice”服务器处理器的最新技术白皮书,重点展示了其在数据中心、云计算、高性能计算以及代理式人工智能(Agentic AI)场景下的性能表现。 白皮书中的多项测试结果直接将矛头对准
摘要:前几个月,OpenAI和Anthropic轮番把旗舰模型往前推,Google却显得异常安静。Flash几乎3周一更,3.6、3.7、3.8连续往前,但代表最高能力上限的Pro迟迟没有动静。直到这两天,大模型盲测竞技场Arena里,突然
摘要:AI圈又一力作诞生。近日,DeepSeek v4.1发布,其算子负责人刘胜与发了一篇长文,标题叫《我不得不把才华埋葬在昨天》。内容过长,全文放在最后了。 这篇文章一发出来就在国内外引起不小轰动,外网已经被翻译成多语言传播。文章开篇他写