1mo ago
涨价后的 DeepSeek 来了,我打算把 V4-Flash 换成 GPT-5.6-Luna,还多了个视觉模态,不过 GTP 的缓存命中没这么优惠
1mo ago
测了下最近新出的模型: Grok-4.6、DS-V4-Pro-0813、GLM-5.3、Gemini-3.7-Flash Prompt:生成一个棒球的网页游戏,要有中英文 前端主观上我更喜欢 GLM-5.3 ,后端代码实现上 Grok-4.6 最完整,能击打和瞄准,有好球、坏 …
1mo ago
Grok 送了一次重置周额度,大家记得用
1mo ago
Qwen3.8-27B-4bit 本地部署,我拿 M1 Pro 32GB 实测了下 生成速度 10 tok/s,一句话等两三秒才开始出字。长 prompt 预填充等一分钟以上,128K 上下文理论上支持。 M1 Pro 上 27B 能跑得起来,但拿来做日常工具还差点意思。想要 …
1mo ago
Qwen3.8-27B 开源了,硬刚 Opus4.6 dense 模型,混合架构,原生视觉语言模型,能看图看视频。 SWE-bench Pro 61.7(超 Opus4.6 Max 的 53.4);LiveCodeBench 90.3(同参数第一);OSWorld 84.3( …
1mo ago
ChatGPT macOS 桌面端出了个 Computer History 类似于之前的 Pieces.app ,记录你在电脑上点什么、打开什么、切什么应用,不截屏,用无障碍 API 抓交互事件。 整理成时间线,ChatGPT 和 Codex 后续对话能直接调用。
1mo ago
智谱发布了 GLM-5.3,同一个 743B 基座,纯靠后训练把编码能力拉高 50%。 745B 总参数,44B 激活,华为昇腾训练,MIT 计划开源。 Terminal Bench 3.0 从 4.6 → 28.3(6倍),网络安全在 CyberGym 超过所有闭源模型。
1mo ago
DeepSeek 涨得有点凶,高了近五倍 V4-Pro 高峰时段输出从 ¥6 → ¥27,涨了 4.5 倍(350%)。 空闲时段 ¥13.5,也比涨价前贵一倍多。
1mo ago
Google 刚发了 Gemini 3.7 Flash 3.7 Flash 软件工程 65.3%,逼近 GPT-5.6 Luna 的 67%。 价格直接砍半 $0.75/$3.75(促销到年底)。 3 周迭代一次还降价,Flash 系列现在真的挺卷的。
1mo ago
DeepSeek 开源了一个 agent harness 亮点是所有功能即插即用,模型适配器、工具注册、session 日志、agent 循环本身,全是可替换插件,底层 Cordis 驱动。 内置了几十个插件,卸载时自动回滚注册(工具、prompt 段、监听器),不需要手动清 …