GLM-5.3、Kimi K3、V4 Pro在同一个基座上的三轮PK 把GLM-5.3、Kimi K3、DeepSeek V4 Pro三个模型塞进DeepSeek Harness,用完全相同的Prompt做《牛来》动作小游戏、AI PPT工作台、餐馆经营游戏三轮实测。结果:GLM-5.3最稳最完整、K3视觉最精致、V4 Pro性价比第一,Harness作为基座完全OK。 AI新纪元 2026年08月19日 0 点赞 0 评论 27 浏览
Claude 全线开启隐形文本水印:双层溯源机制全球生效,但检测结果不能当作实锤证据 Anthropic 为 Claude 全产品线部署双层隐形水印,文本标记可跟随内容复制流转,文件搭载 C2PA 溯源签名。需要注意水印检测结果仅具备参考价值,无法直接判定内容是否由 AI 原生生成。同时对比 Gemini、OpenAI 的文本水印相关进展。 AI新纪元 2026年08月12日 0 点赞 0 评论 41 浏览
亲测一周后深度拆解GLM-5.3:744B参数如何冲进全球第四 作者亲测GLM-5.3一周后带来深度体验报告:该模型以744B(激活40B)参数在AA榜单冲至全球第四,与2.8T的Kimi K3打平。文章通过安全审查、Skill开发、3D游戏与写作四个实战案例,拆解其同底座纯后训练提分的路线,并附开源时间与API价格信息。 AI新纪元 2026年08月22日 0 点赞 0 评论 23 浏览
OpenAI终于把"看图干活"玩明白了:目标检测得分翻三倍 第三方评测机构Roboflow把OpenAI最新GPT-5.6全家桶拉进视觉基准实测:旗舰Sol的目标检测得分较上一代暴涨三倍,从 AI新纪元 2026年08月18日 0 点赞 0 评论 31 浏览
唐杰拆解Scaling Law新思路:万亿参数是行业走过的弯路,真正的旋钮在别处 智谱创始人唐杰公开发文,以GLM-5.3做"控制变量实验",论证参数量并非模型能力的唯一指标:后训练等环节才是提升空间最大的旋钮,万亿参数曾是行业绕行的弯路。 AI新纪元 2026年08月20日 0 点赞 0 评论 23 浏览
谷歌紧急上新:Gemini 3.7 Flash三周迭代,先降价再谈性能 距离上一代仅三周,谷歌发布Gemini 3.7 Flash,主攻编程、智能体与网页开发,API价格在年底前砍半。但第三方测评显示其长程工程能力仍落后GPT-5.6 Terra,性价比能否撑住场? AI新纪元 2026年08月14日 0 点赞 0 评论 52 浏览
OpenAI旗舰模型Astra(GPT-6)内部测试demo疯传,最快本周四正式亮相 OpenAI下一代旗舰模型Astra(疑似GPT-6)的内部测试demo近期在社交平台引发轰动,展现出惊人的3D建模和自动纠错能力。经历安全评估推迟后,该模型最快将于本周四正式面向公众发布。 AI新纪元 2026年08月31日 0 点赞 0 评论 22 浏览
"性价比之王"要涨价的账,DeepSeek算得清吗 DeepSeek大幅涨价,峰时输出价格涨至4.55倍,被视为性价比之王的标签被动摇。订阅平台下调额度、第三方托管出现套利空间、Harness生态既带来机会也埋下可被替换的隐患——涨价背后是DeepSeek对品牌溢价的一次试探。 AI新纪元 2026年08月19日 0 点赞 0 评论 28 浏览