5d ago
CommandCode 一美元套餐也提供 GPT-5.6-Luna 了
不过只有 20 美元的调用额度,远不及 DeepSeek-V4-Pro 的40 美元。
5d ago
MacBook 请上岛
这两天我深度测试了下 DeepSeek-v4-flash-0731 的全栈开发能力,做了个 macOS 灵动岛app。岛上可以媒体控制、文件暂存、显示系统信息。
先说结论,后端能力的确能达到 glm-5.2 的水平,但因为没有视觉模态,前端能力排不上 …
8d ago
DeepSeek-V4-Flash 正式版来了,吊打 GLM-5.2
我看官方介绍,参数是一样的,纯靠后训练把几个 agent benchmark 干到第一。
DeepSWE 7.3→54.4,Terminal Bench 2.1 得到 82.7 紧追 Opus-4.8 …
8d ago
GPT-5.6 Luna 降价 80%
对比下 DeepSeek-v4-Pro 的价格,打算把我的工作流的 subagent 模型换成 Luna 。
现在是 Grok-4.5 或 Kimi-K3 编排, Luna 干活,等我看看效果
8d ago
发现一个很有意思的现象,我打算做个付费产品,要接入能用的多模态模型,同时要考虑成本。
选来选去居然只有小米的 MiMo-V2.5 符合条件,这么看来现在热门大模型都挺“偏科”的,果然任何事不能既要又要。
9d ago
这些天我把六年前写的一个类“按键精灵”的项目改成由 agent 驱动。
这类项目天然跟 agent 比较契合,把所有功能(找图、找色、键鼠操作)封装成工具给 agent 调用,要比 agent 实时识别图片,操作快很多。
9d ago
grok 自带服务器了
现在的 grok app 真的很屌,之前发过 grok 有自己的服务器运行 skills ,现在 grok 可以在自己的服务器跑项目了。
等于每个 grok 账号自带一台云服务器,用户可以在云服务器里开发项目,手机端和网页端接力开发。 …
9d ago
免费用 Qwen3.8
阿里推出了 Qwen Growth Plan(Qwen 成长计划)
参与方式是用 Qwen3.8-Max-Preview 跑你的真实项目,然后把好案例 / 翻车案例私聊给官方,就可以拿奖励。
现在 preview 期间 Credits …
9d ago
supergrok 的计费模式算是摸清了
supergrok 周额度是固定的,其中包含 xai、buil、聊天。区别在于计费倍数和缓存。
首先 xai 计费倍数明显高于 build ,其次我用 9router 反向代理 build 吃不到任何缓存,只有用 build cli …
10d ago
1.5 刀包月了 50 个 IP
跑 opencode 的 deepseek-v4-flash 接入 hermes ,实践下来真不错,日常够用了,量大管饱。