大模型

亲测一周后深度拆解GLM-5.3:744B参数如何冲进全球第四

作者亲测GLM-5.3一周后带来深度体验报告:该模型以744B(激活40B)参数在AA榜单冲至全球第四,与2.8T的Kimi K3打平。文章通过安全审查、Skill开发、3D游戏与写作四个实战案例,拆解其同底座纯后训练提分的路线,并附开源时间与API价格信息。

"性价比之王"要涨价的账,DeepSeek算得清吗

DeepSeek大幅涨价,峰时输出价格涨至4.55倍,被视为性价比之王的标签被动摇。订阅平台下调额度、第三方托管出现套利空间、Harness生态既带来机会也埋下可被替换的隐患——涨价背后是DeepSeek对品牌溢价的一次试探。

唐杰谈Scaling Law新标尺:大模型评价从“数参数”走向“算算力”

智谱创始人唐杰发文重思Scaling Law:参数量并非衡量模型能力的唯一标尺,行业评价正从“数参数”转向“算算力”。从万亿参数Switch-C的“参数失灵”,到GLM-5.3凭后训练实现能力跃升,唐杰详解总参数、激活参数与FLOPs之辨,指出算力分配与使用效率才是决定产品上限的关键。

1900名大学生,在国产算力上"手搓"大模型

第七届全国大学生计算机系统能力大赛智能计算创新设计赛(先导杯)迎来巅峰对决,160所高校、500多支队伍、1900多名大学生在国产算力上做起了大模型推理优化。这场国赛正在把产业一线需求变成年轻人的实战现场。