唐杰谈Scaling Law新标尺:大模型评价从“数参数”走向“算算力” 智谱创始人唐杰发文重思Scaling Law:参数量并非衡量模型能力的唯一标尺,行业评价正从“数参数”转向“算算力”。从万亿参数Switch-C的“参数失灵”,到GLM-5.3凭后训练实现能力跃升,唐杰详解总参数、激活参数与FLOPs之辨,指出算力分配与使用效率才是决定产品上限的关键。 AI新纪元 2026年08月22日 0 点赞 0 评论 20 浏览
1900名大学生,在国产算力上"手搓"大模型 第七届全国大学生计算机系统能力大赛智能计算创新设计赛(先导杯)迎来巅峰对决,160所高校、500多支队伍、1900多名大学生在国产算力上做起了大模型推理优化。这场国赛正在把产业一线需求变成年轻人的实战现场。 AI新纪元 2026年08月17日 0 点赞 0 评论 29 浏览
DeepSeek悄然开启V4.1 Flash内测:原生多模态成最大看点 DeepSeek在官方交流群中开启V4.1 Flash中间版本内测,首次明确提出新模型结构和原生多模态支持,同时在能力、速度和成本上进一步优化。该版本可能在9月10日到期,疑似正式发布前的短期测试。 AI新纪元 2026年09月08日 1 点赞 0 评论 30 浏览
安全闸门再次拉下:OpenAI放缓前沿模型训练的深层用意 OpenAI再次以安全为由放缓前沿模型训练:暂停RL训练两周、引入激活分类器实时监控词元,并收紧Astra等先进模型的安全标准。新公告也让Astra的发布时点变得更加扑朔迷离。 AI新纪元 2026年08月19日 0 点赞 0 评论 28 浏览
2.4T 参数开源之后:旗舰大模型为什么越卷越像 阿里开放 Qwen3.8-2.4T 模型权重,与 Kimi K3 一道把旗舰开源模型推上同一张架构图纸。本文梳理参数、注意力结构、推理部署与许可证的变化,并讨论行业趋同背后竞争点的迁移。 AI新纪元 2026年08月13日 0 点赞 0 评论 47 浏览
宇树上市,真正的好戏才刚刚开场 宇树科技登陆科创板,发行市值609.93亿元,成为A股第一家人形机器人上市公司。十年从四足机器狗到人形机器人,王兴兴用产品和技术迭代赢得了市场,但真正的悬念——大模型 科技数码 2026年08月19日 0 点赞 0 评论 34 浏览
斯坦福学者全程直播5350亿参数大模型训练,揭开AI黑箱 斯坦福大学教授Percy Liang宣布全程公开训练5350亿参数模型Marin 535B,所有训练曲线、日志和工程细节实时可见,此举被视为开源精神的典范。 AI新纪元 2026年08月25日 0 点赞 0 评论 31 浏览
DeepSeek Harness首发大版本更新:多模态能力补全 DeepSeek Harness公测后首迎大版本更新,14项调整落地,原生图片输入、图文混合指令补齐全,Claude Code与Codex接入子代理体系,Windows终端体验同步优化。 AI新纪元 2026年08月20日 0 点赞 0 评论 23 浏览
唐杰那句“sooooooon”说到做到,GLM-5.3带着编程和安全两把刷子上线 智谱在唐杰喊话后数小时火速发布GLM-5.3,专注编程与安全双赛道:终端多步操作能力提升五倍,CyberGym安全得分登顶。本文拆解新模型的关键数据与Agent能力布局。 AI新纪元 2026年08月14日 0 点赞 0 评论 44 浏览
AI人才争夺白热化:实习生日薪五千,顶尖研究员年薪过亿 从硅谷到中国,AI人才争夺战全面打响。顶尖研究员年薪可达上亿,博士实习生日薪高达5000元。字节、腾讯、阿里等大厂与创业公司之间展开激烈的人才拉锯战,核心技术人员的流动正在重塑整个AI行业格局。 AI新纪元 2026年09月08日 0 点赞 0 评论 29 浏览