2.8 万亿参数全球最大开源模型——Kimi K3 前端代码登顶,但综合智能还差一截 月之暗面发布Kimi K3:2.8T参数、896专家MoE、KDA注意力、1M上下文。Frontend Code Arena超Fable 5登顶。
GPT-5.6 删了你的整个家目录——OpenAI 说是「误判」,但第三次了 GPT-5.6在Codex full-access模式下误删$HOME目录,7月9日上线以来第三次文件删除事故。沙盒不是限制,是救命。
Codex 默认皮肤丑到想退款——3.5K 人连夜给它换了张脸,有人已经拿去卖钱了 Codex Dream Skin用CDP注入给Codex换主题,8款皮肤免费换、一键还原、不改官方安装包。初音/黑金/财神打工任选。
1.9 元买 1.8 亿 Token——云知声这波补贴,比 DeepSeek 还狠 云知声Token Hub上线1.9元/月1.8亿Credits套餐,含GLM-5.2+U2+医疗+OCR+ASR+TTS 8大模型。但Credits≠Tokens、续费涨5倍——代价你算过吗?
AI 写了代码却从没跑过手机——3.4 万人决定给它装双手 Callstack开源agent-device,让AI Agent直接操控iOS/Android真机验证。Token消耗砍半、跨7平台、录制回放一条龙。
744B 模型需要 1.5TB 显存——有人用 25GB 内存就跑起来了,但每秒只吐 0.05 个字 Colibrì用纯C写了个2400行推理引擎,把GLM-5.2的744B参数拆成9.9GB常驻+370GB硬盘按需加载,25GB内存就能跑。但冷启动0.05 tok/s——代价你算过吗?
744B 模型需要 1.5TB 显存——有人用 25GB 内存就跑起来了,但每秒只吐 0.05 个字 Colibrì用纯C写了个2400行推理引擎,把GLM-5.2的744B参数拆成9.9GB常驻+370GB硬盘按需加载,25GB内存就能跑。但冷启动0.05 tok/s——代价你算过吗?
744B 模型需要 1.5TB 显存——有人用 25GB 内存就跑起来了,但每秒只吐 0.05 个字 Colibrì用纯C写了个2400行推理引擎,把GLM-5.2的744B参数拆成9.9GB常驻+370GB硬盘按需加载,25GB内存就能跑。但冷启动0.05 tok/s——代价你算过吗?