动态
浩伊的最新动态,聚焦 AI 生产力工具、Claude、ChatGPT、AI Agent、RAG 知识库、AI 自动化与独立开发。
1mo ago
DeepSeek-V4-Pro-0813 静默上线,能力直逼 Fable-5
DeepSeek 没发任何公告,直接改了 API 版本。架构没变,还是 1.6T MoE / 49B 激活,但后训练重做后 Agent 能力起飞。
1M上下文,384K输出,三档推理。API …
1mo ago
Grok 4.6 可以用了
500K 上下文,四档推理(默认 high),知识截止 2026.2.1。
定价:输入 $2/M,输出 $6/M,长上下文(≥200K)翻倍。
官方定位 coding + agent 专用模型。目前 Cursor、Grok …
1mo ago
微信出大模型了,叫WeLM
两个版本,都是MoE。
- WeLM-80B:80B参数,3B激活,已上线微信"小微"
- WeLM-617B:617B参数,23B激活,开发中
3B激活跑80B总参,第一次见压缩这么激进的MoE。
微信“小微”不需要装任何东西,打开就能用。这可 …
1mo ago
xAI 发布了 Grok Bot,亮点是持久化云 VM(云端桌面虚拟机)
每个 Bot 有自己的浏览器、文件系统和终端,本地关电脑后照跑。
用自己的凭证登录工具,不需要 API 集成。多步骤任务端到端完成,只在需要审批时才找你。
捆绑 Cursor Ultra $200/ …
1mo ago
前几天前司知识库崩了,Google 改了 NotebookLM 接口,本地数字员工直接断联。
于是我做了个轻量化本地知识库技能:local-rag。
一句话能装好
把这行发给你的智能体:
给你自己安装这个技能(skill):haoyiyin/local-rag
不用服 …
1mo ago
自己设计,也用过不少 harness ,我现在深有体会。越强的模型越不需要复杂的 harness ,约束的越多反而会限制强模型的发挥,做好简单的熔断机制就行。
相反越弱的模型越需要 harness 去控制模型的方向,所以又引申出一个问题,用弱模型通常是考虑成本。但弱模型成功率 …
1mo ago
今天收到了 workspace 免费 AI 试用邮件,现在 Google 也就 Nano Banana Pro 能拿得出手。
免费用户还可以在 Flow( labs.google/fx/tools/flow ) 里调用 Nano Banana Pro ,每天给的额度还算慷慨,生 …
1mo ago
Cloudflare 造了个 agent 专属浏览器 Kitesurf
不在本地跑 Chromium,而是跑在 Cloudflare Workers 云端上。
官方宣称,DOM/HTML 提取比 Chromium **省 3-7 倍 CPU 和内存**。agent 不需要标签 …
1mo ago
🦞 龙虾毕业版
Prime Intellect 开源了 Prime Agent ,是一个基于 pi 二次开发的全新 agent harness。
Prime Agent 所有操作都通过代码完成。子任务直接递归拆解,调用 subagent 并发完成。
agent 还能从工作过 …
1mo ago
一些开发的思路
现在的开源项目价值不仅仅是二次开发,更多是学习里面的设计思路。比如我这个“发条”项目最开始的文档编辑器是内置了迷你 Office 原生编辑器。
编辑生成的文档前要转成标准的 Office 格式,才可以在应用内编辑。现在学习了 cloudfalre-os 的编辑 …