唐杰拆解Scaling Law新思路:万亿参数是行业走过的弯路,真正的旋钮在别处 智谱创始人唐杰公开发文,以GLM-5.3做"控制变量实验",论证参数量并非模型能力的唯一指标:后训练等环节才是提升空间最大的旋钮,万亿参数曾是行业绕行的弯路。 AI新纪元 2026年08月20日 0 点赞 0 评论 22 浏览
谷歌紧急上新:Gemini 3.7 Flash三周迭代,先降价再谈性能 距离上一代仅三周,谷歌发布Gemini 3.7 Flash,主攻编程、智能体与网页开发,API价格在年底前砍半。但第三方测评显示其长程工程能力仍落后GPT-5.6 Terra,性价比能否撑住场? AI新纪元 2026年08月14日 0 点赞 0 评论 51 浏览
OpenAI旗舰模型Astra(GPT-6)内部测试demo疯传,最快本周四正式亮相 OpenAI下一代旗舰模型Astra(疑似GPT-6)的内部测试demo近期在社交平台引发轰动,展现出惊人的3D建模和自动纠错能力。经历安全评估推迟后,该模型最快将于本周四正式面向公众发布。 AI新纪元 2026年08月31日 0 点赞 0 评论 22 浏览
"性价比之王"要涨价的账,DeepSeek算得清吗 DeepSeek大幅涨价,峰时输出价格涨至4.55倍,被视为性价比之王的标签被动摇。订阅平台下调额度、第三方托管出现套利空间、Harness生态既带来机会也埋下可被替换的隐患——涨价背后是DeepSeek对品牌溢价的一次试探。 AI新纪元 2026年08月19日 0 点赞 0 评论 28 浏览
唐杰谈Scaling Law新标尺:大模型评价从“数参数”走向“算算力” 智谱创始人唐杰发文重思Scaling Law:参数量并非衡量模型能力的唯一标尺,行业评价正从“数参数”转向“算算力”。从万亿参数Switch-C的“参数失灵”,到GLM-5.3凭后训练实现能力跃升,唐杰详解总参数、激活参数与FLOPs之辨,指出算力分配与使用效率才是决定产品上限的关键。 AI新纪元 2026年08月22日 0 点赞 0 评论 19 浏览
1900名大学生,在国产算力上"手搓"大模型 第七届全国大学生计算机系统能力大赛智能计算创新设计赛(先导杯)迎来巅峰对决,160所高校、500多支队伍、1900多名大学生在国产算力上做起了大模型推理优化。这场国赛正在把产业一线需求变成年轻人的实战现场。 AI新纪元 2026年08月17日 0 点赞 0 评论 29 浏览
DeepSeek悄然开启V4.1 Flash内测:原生多模态成最大看点 DeepSeek在官方交流群中开启V4.1 Flash中间版本内测,首次明确提出新模型结构和原生多模态支持,同时在能力、速度和成本上进一步优化。该版本可能在9月10日到期,疑似正式发布前的短期测试。 AI新纪元 2026年09月08日 1 点赞 0 评论 30 浏览
安全闸门再次拉下:OpenAI放缓前沿模型训练的深层用意 OpenAI再次以安全为由放缓前沿模型训练:暂停RL训练两周、引入激活分类器实时监控词元,并收紧Astra等先进模型的安全标准。新公告也让Astra的发布时点变得更加扑朔迷离。 AI新纪元 2026年08月19日 0 点赞 0 评论 28 浏览
2.4T 参数开源之后:旗舰大模型为什么越卷越像 阿里开放 Qwen3.8-2.4T 模型权重,与 Kimi K3 一道把旗舰开源模型推上同一张架构图纸。本文梳理参数、注意力结构、推理部署与许可证的变化,并讨论行业趋同背后竞争点的迁移。 AI新纪元 2026年08月13日 0 点赞 0 评论 46 浏览
斯坦福学者全程直播5350亿参数大模型训练,揭开AI黑箱 斯坦福大学教授Percy Liang宣布全程公开训练5350亿参数模型Marin 535B,所有训练曲线、日志和工程细节实时可见,此举被视为开源精神的典范。 AI新纪元 2026年08月25日 0 点赞 0 评论 30 浏览