OpenAI终于把"看图干活"玩明白了:目标检测得分翻三倍 第三方评测机构Roboflow把OpenAI最新GPT-5.6全家桶拉进视觉基准实测:旗舰Sol的目标检测得分较上一代暴涨三倍,从 AI新纪元 2026年08月18日 0 点赞 0 评论 30 浏览
亲测一周后深度拆解GLM-5.3:744B参数如何冲进全球第四 作者亲测GLM-5.3一周后带来深度体验报告:该模型以744B(激活40B)参数在AA榜单冲至全球第四,与2.8T的Kimi K3打平。文章通过安全审查、Skill开发、3D游戏与写作四个实战案例,拆解其同底座纯后训练提分的路线,并附开源时间与API价格信息。 AI新纪元 2026年08月22日 0 点赞 0 评论 23 浏览
唐杰拆解Scaling Law新思路:万亿参数是行业走过的弯路,真正的旋钮在别处 智谱创始人唐杰公开发文,以GLM-5.3做"控制变量实验",论证参数量并非模型能力的唯一指标:后训练等环节才是提升空间最大的旋钮,万亿参数曾是行业绕行的弯路。 AI新纪元 2026年08月20日 0 点赞 0 评论 23 浏览
谷歌紧急上新:Gemini 3.7 Flash三周迭代,先降价再谈性能 距离上一代仅三周,谷歌发布Gemini 3.7 Flash,主攻编程、智能体与网页开发,API价格在年底前砍半。但第三方测评显示其长程工程能力仍落后GPT-5.6 Terra,性价比能否撑住场? AI新纪元 2026年08月14日 0 点赞 0 评论 52 浏览
OpenAI旗舰模型Astra(GPT-6)内部测试demo疯传,最快本周四正式亮相 OpenAI下一代旗舰模型Astra(疑似GPT-6)的内部测试demo近期在社交平台引发轰动,展现出惊人的3D建模和自动纠错能力。经历安全评估推迟后,该模型最快将于本周四正式面向公众发布。 AI新纪元 2026年08月31日 0 点赞 0 评论 22 浏览
"性价比之王"要涨价的账,DeepSeek算得清吗 DeepSeek大幅涨价,峰时输出价格涨至4.55倍,被视为性价比之王的标签被动摇。订阅平台下调额度、第三方托管出现套利空间、Harness生态既带来机会也埋下可被替换的隐患——涨价背后是DeepSeek对品牌溢价的一次试探。 AI新纪元 2026年08月19日 0 点赞 0 评论 28 浏览
唐杰谈Scaling Law新标尺:大模型评价从“数参数”走向“算算力” 智谱创始人唐杰发文重思Scaling Law:参数量并非衡量模型能力的唯一标尺,行业评价正从“数参数”转向“算算力”。从万亿参数Switch-C的“参数失灵”,到GLM-5.3凭后训练实现能力跃升,唐杰详解总参数、激活参数与FLOPs之辨,指出算力分配与使用效率才是决定产品上限的关键。 AI新纪元 2026年08月22日 0 点赞 0 评论 20 浏览
1900名大学生,在国产算力上"手搓"大模型 第七届全国大学生计算机系统能力大赛智能计算创新设计赛(先导杯)迎来巅峰对决,160所高校、500多支队伍、1900多名大学生在国产算力上做起了大模型推理优化。这场国赛正在把产业一线需求变成年轻人的实战现场。 AI新纪元 2026年08月17日 0 点赞 0 评论 29 浏览
2.4T 参数开源之后:旗舰大模型为什么越卷越像 阿里开放 Qwen3.8-2.4T 模型权重,与 Kimi K3 一道把旗舰开源模型推上同一张架构图纸。本文梳理参数、注意力结构、推理部署与许可证的变化,并讨论行业趋同背后竞争点的迁移。 AI新纪元 2026年08月13日 0 点赞 0 评论 47 浏览
DeepSeek悄然开启V4.1 Flash内测:原生多模态成最大看点 DeepSeek在官方交流群中开启V4.1 Flash中间版本内测,首次明确提出新模型结构和原生多模态支持,同时在能力、速度和成本上进一步优化。该版本可能在9月10日到期,疑似正式发布前的短期测试。 AI新纪元 2026年09月08日 1 点赞 0 评论 30 浏览