IDEAS · SIGNALS · BUILDS
2026年8月20日星期四
DRAFT
REVIEW
LIVE
乔氪智造
Ideas, Signals, Builds.
首页
日报
文库
工具雷达
榜单
AI 全景
⌕
搜索
· · ·
ZH
EN
搜索
搜索
“agent” 找到 80 条
工具 (40)
8.5
Claude Opus 4.7
model
目前最强大的通用AI模型之一,但价格昂贵且推理速度较慢
8.5
1Password
app
密码管理领域的标杆产品,但企业版定价较高
8.2
GitHub Copilot
devtool
目前最成熟的AI编程助手,但价格偏高且对复杂逻辑支持有限
7.7
Claude Code
devtool
强大的AI编码工具但价格较高,适合预算充足的团队
7.6
Notion 3.4
app
Notion 3.4 提供了更智能的 AI 代理和仪表板,但核心功能未突破
7.3
OpenAI Codex
devtool
强大的AI编程助手,但依赖OpenAI生态且价格不透明
7.2
LangChain
library
功能全面但过于复杂,适合需要快速集成多种LLM功能的团队
7.2
warpdotdev/warp
devtool
创新的终端工具但生态尚不成熟
7.1
Grok 4
model
性能强劲但计算资源消耗大,适合有预算的企业级AI应用
7.1
腾讯云宣布开源 OpenAI、Manus 同款 Agent 底座
infra
CubeSandbox作为AI Agent的硬件级隔离沙箱,其亚百毫秒启动和E2B兼容性为Agent执行环境带来了显著的安全和性能提升。
7.0
Replit
app
创新的云端IDE但AI功能尚不成熟
7.0
Tines 3B
platform
功能强大但定位狭窄,安全团队才会真正受益
6.9
Qwen3.7-Max: The Agent Frontier
model
强大的中文大模型但生态支持不足
6.9
Mixpanel Headless
platform
Mixpanel Headless为开发者提供了强大的产品分析API,但学习曲线较陡且更适合技术团队。
6.9
alibaba/open-code-review
library
阿里巴巴内部验证的代码审查工具,但社区生态尚未成熟
6.9
实测正式版 DeepSeek V4 Pro,补齐 Agent 和图像能力
model
DeepSeek V4 Pro 在中文场景表现突出,但整体竞争力仍被 OpenAI 等大厂压制。
6.8
Fabi
platform
Fabi是一个有潜力的AI驱动内部工具构建平台,但其核心AI代理的实际能力和可靠性仍需时间验证。
6.8
Voker (YC S24) – Analytics for AI Agents
platform
Voker是一个有前途的AI代理分析平台,但其核心功能与现有LLM可观测性工具重叠,需要证明其代理特定功能的独特价值。
6.8
Prometheus by Firecrawl
platform
Prometheus by Firecrawl是一个有前景的AI驱动网页数据提取平台,它通过抽象复杂的爬虫基础设施,让数据获取变得简单,但其AI提取的准确性和可控性仍需时间验证。
6.7
Runtime
platform
Runtime是一个有前景的AI代理沙盒平台,但其价值高度依赖于AI代理本身的成熟度,目前仍是早期市场。
6.7
gemma-4-12B-agentic-fable5-composer2.5-v2-3.5x-tau2-GGUF
model
功能强大,但过于复杂,难以上手
6.7
「说 Harness 会被淘汰的,肯定没做过工程」,Kimi 前 CLI 负责人戳破了 AI 圈最大的误解
devtool
Harness 作为 DevOps 工具,其价值并非完全由 AI 模型决定,忽视其实际工程能力是短视的。
6.6
Dify
platform
一个功能全面但略显臃肿的LLM应用开发平台,适合快速搭建但可能缺乏深度定制
6.6
Windsurf
devtool
有潜力的AI IDE,但被收购后发展方向不确定
6.6
Superset 2.0
platform
一个有前途的AI代理编排平台,但其大规模部署的承诺可能超出了大多数团队的当前需求。
6.6
Agents can now create Cloudflare accounts, buy domains, and deploy
devtool
自动化部署工具的创新尝试,但适用范围有限
6.6
InstaVM
platform
InstaVM为AI代理提供快速、隔离的计算环境,解决了代理开发中的一个实际痛点,但其独特价值和长期竞争力仍需观察。
6.6
Pitch Agent
app
Pitch Agent 是一个有用的 AI 演示文稿生成器,但它在拥挤的市场中缺乏真正的独特之处,其 AI 输出质量仍需验证。
6.6
Agent A by Ahrefs
app
Ahrefs数据驱动的营销AI助手,适合SEO专家但功能有限
6.5
Mastra
library
功能全面但定位模糊的AI代理框架,工具集成是亮点但核心价值不突出
6.5
Qwen-AgentWorld-35B-A3B
model
模型功能强大,但文档不足,难以全面评估其潜力。
6.4
ClawTick
platform
一个有前景的AI代理调度平台,但作为新产品,其长期可持续性仍是未知数。
6.4
阿里 Qoder 推出 Cloud Agents,Agent 上线仅需 1 天
platform
阿里Qoder的Cloud Agents平台简化了AI Agent部署流程,但作为新平台其长期稳定性和生态成熟度有待验证
6.4
Jockey by TwelveLabs
app
功能新颖但仍在起步,适合需要快速检索大量视频素材的团队。
6.3
腾讯 QClaw 大升级:支持 Hermes,接入 DS-V4、Hy3 preview
app
腾讯生态内的多功能AI助手,但生态封闭且功能分散
6.3
ReleaseDock
platform
ReleaseDock通过将AI支持、帮助中心和更新日志整合到一个平台中,为产品团队提供了一个便捷的工具,但其长期竞争力仍有待观察。
6.2
Kilo Code v7 for VS Code
devtool
Kilo Code通过其多模型比较和并行代理功能,在拥挤的AI编码助手市场中提供了一些独特的价值,但其核心实用性仍需与成熟竞品竞争。
6.2
Vivago Video Agent
app
一个有前景的AI视频生成应用,但其“免提示词”的独特卖点能否真正带来“始终引人入胜”的视频,仍需时间验证。
6.2
Agentspan
library
Agentspan为构建持久化、有状态的AI代理提供了一个有用的运行时,但其核心价值仍依赖于AI代理概念的实际落地。
6.2
Parsewise API
platform
一个用于多文档处理的API,声称具有代理能力,但其核心功能在竞争激烈的市场中并非独一无二。
文章 (40)
律师让 AI 找案例,法官一查全是编的
一位律师给法院交了两份判例,其中一份案号是(2022)沪01民终12345号。法官拿这个案号一检索,真实案子是民间借贷,跟本案的股权代持毫无关系。他承认这两份判例是提炼关键词后反复问 AI 得来的,没做任何核实。这个案子
21 个免费大模型入口,实测只有 9 个能用
六天前那篇说 13 个入口挂了 4 个,这几天又加了几个,我把现在全部 21 个挨个调了一遍:9 个能用、5 个限流、7 个已死。但更有用的不是这几个数字,而是同一个模型现在往往挂在好几个平台上,可用性完全不同。gpt-
AI 写了一个月代码,人类只提交 13 次
阿里说 Qwen3.8 从一个空文件夹出发、无人干预自己写了十几天代码。所有报道都在转述同一组官方数字,我把那个仓库拉下来读了一遍:主分支 841 次提交,AI 828 次,人类 13 次。而人类那 13 次里,八次全是
DeepSeek V4 Pro:隐藏大招重塑开发者
DeepSeek V4 Pro 通过系统提示注入绕过安全,提升效率却削弱防御,需警惕。
人越来越老,AI 能让我们跳出循环吗
公元 1 年全球人均 GDP 约 444 国际元,一千年后是 435,人类历史绝大部分时间是停在原地的。工业革命把「生产率增长 > 人口增长」这个公式反转过来,现代福利国家就架在这个公式上。今天两个变量同时反转:生育率跌
13 个免费大模型,一个月挂了 4 个
我服务器上挂着一份 7 月 12 日逐个真调校准过的免费大模型清单,13 个入口。昨天原样重跑,挂了 4 个:GitHub Models 已在 7 月 30 日彻底退役、ModelScope 模型下架、OpenRoute
别让 Agent 自己检查自己的活
专用领域 Agent 系列 06。有些活不该主循环自己干。子 Agent 解决三件事:并行、上下文隔离、客观性。野行 Y 的 research 子 Agent 并行核实+隔离噪音,critic 子 Agent 换个干净脑
Agent 的记忆,记岔了比没记更坑
专用领域 Agent 系列 05。记忆系统让 Agent 跨会话记住用户是谁,但最容易在两个地方栽跟头:记岔了(会编记忆的 Agent 比没记忆的更糟,宁可返回空)、生搬硬套(记忆是背景参考不是硬指令,当次意图优先)。
上下文窗口就那么大,Agent 设计应该怎么分
专用领域 Agent 系列 04。模型每一轮知道的一切,就是这次喂进窗口的那些字。这篇讲上下文工程:一个工具结果喂给模型和用户两个版本、瘦身取舍的核心是判断哪个字段碰不得、在工具边界就地蒸馏、以及主动注入当前日期和用户画
模型再聪明,也得穿过工具这道门
专用领域 Agent 系列 03。工具就是 Agent 能对世界做的全部动作,工具集就是这个领域的动作词典。这篇讲怎么把一个模糊任务拆成动作词典,以及工具设计反复落在的五种模式:搜索、估算、推荐、核实、选择。
我给 Agent 写的循环,一半是护栏
专用领域 Agent 系列 02。野行 Y 的地基是一个模型驱动的循环。这篇拆开讲它在代码里怎么转、为什么不能写成流水线,以及最花力气的那圈护栏:文字糊弄拦回、查上瘾撤工具、出报告前必先确认、换脑子核对硬伤、墙钟闸逼收尾
一个专用领域 Agent,我是怎么搭的
我做了个自驾路线规划 Agent 叫野行 Y。这篇不写旅行,写它整体怎么搭起来——通用架构 × 专业能力两层、十来个模块,从循环、工具、上下文到数据真实性、判断层,一层层拆开。
AI 一小时证出 50 年数学难题?
7 月 10 日,OpenAI 扔出一份 PDF:最新模型 GPT-5.6 Sol Ultra 不到一小时、用 64 个子智能体并行,产出了「循环双覆盖猜想」——一道 50 年没解开的图论难题——的机器可验证证明,署名直
一针百万的抗癌药,正被打到 20 万
国内有一种治血液癌的药 CAR-T,一针要 99 万到 129 万,被叫做「医疗奢侈品」,绝大多数家庭想都不敢想。但最近这堵百万的墙开始被砸开一个口子:国产一款 CAR-T 报批价定在约 20 万。从 129 万到 20
全球 AI Coding / Agent 全景白皮书 · 2026
把全世界三十多个 AI 编程与 Agent 工具摆上同一张桌子:两根轴看清定位,一张鲜度快照认出僵尸项目,按场景、系统、远程、安全给落地打法。附完整设计版链接。
GPT-5.6 的政府许可,是 AI 北约的入场券
政府许可的 GPT-5.6 实为地缘政治配给,构建 AI 北约。
Bunny DNS免费了,但你的查询正在被标价
免费DNS实为将用户查询数据货币化,隐私被永久标价出售。
你那个「要是有就好了」,我帮你做出来
你有没有过这种念头:要是有个小工具能帮我自动算清 AA 账就好了、要是有个网页能把我这堆乱路线整理成自驾攻略就好了、要是有个小东西能每天记一下我的情绪就好了……然后你不会写代码,找人做又太兴师动众,于是算了。这个「算了」
AI 公司巨亏,你却用得越来越便宜
你大概也注意到一个拧巴的事:一边新闻天天说 AI 公司疯狂烧钱巨亏(OpenAI 一年估亏一百多亿美元、xAI 每赚 1 块倒贴约 26 块、全行业 capex 估算六千多亿),一边你用的 AI 越来越便宜甚至免费(De
AI 压缩上下文那一下,替你扔了什么
重度用 AI 干活的人,大概都见过那行字——「正在压缩上下文」。那一瞬间,AI 在替你做一件挺重的事:决定你们之前所有的对话和工作,哪些留下、哪些扔掉。而这个决定你基本看不见、默认也插不上手。它扔掉的,可能正是你过会儿要
最会用 AI 的人,在给它建一家公司
你有没有过这种经历:让 AI 干一件长一点的活,开头惊艳你就放手不盯了,结果它干到后面把你反复强调的要求忘得一干二净,还把改好的又改坏,一脸自信。这不是某个 AI 不行,是这一代 AI、尤其是能自己干活的 Agent 一
同一个模型,AI 编程工具为啥差这么多
选编程工具的时候,大家张口第一句几乎都是「它接哪个模型」。但主流编程 agent 模型几乎都能换——Cursor 能切 Claude/GPT/自家 Composer,Cline 让你自带 key 接三十多家,腾讯 Cod
Google 支付 SpaceX 的背后:云计算的军备竞赛
Google 支付 SpaceX 实为争夺数据中心物理位置的战略控制
字节跳动AI战略的隐藏成本
字节AI战略因商业模式妥协而陷入效率主义的平庸
微信刚跟华为、荣耀、小米、OPPO、vivo 联手做 A2A 助手——你日常用微信的方式即将彻底变样
6 月 2 日 IT 之家报道,腾讯客服最新回复显示,微信正与华为、荣耀、小米、OPPO、vivo 等手机厂商合作推出 A2A 助手能力。用户可以通过手机语音助理直接发起微信音视频通话或向指定好友发送消息,全程采用双重授
豆包 6 月下旬要开始付费——月活 3.45 亿用户面前,中国免费 AI 时代真要结束
6 月 1 日 36 氪独家披露,豆包预计 6 月下旬正式上线付费内容,并在同期举行的 Force 原动力大会上更新相关功能。这件事关联的是过去 4 个月国内 AI 价格生态一次彻底的反转——2 月智谱 GLM-5 涨
Anthropic 反超 OpenAI 摸到 1 万亿估值 — 翻开投资人名单 / 它要做的事比卖模型大得多
3 月 OpenAI 拿 1220 亿美元 funding round / 估值 8520 亿。5 月 28 日 Anthropic Series H 拿 650 亿美元 / 投后估值 9650 亿 / 第一次反超 Op
LLM代理的约束衰减:效率主义的隐形陷阱
LLM约束衰减本质是效率优先开发文化导致的系统性风险
Superset IDE:效率主义在AI代理时代的陷阱
全能IDE的臃肿化本质是用规模效益伪装的技术负债
AI 数学证明:工具如何反向塑造数学家的思维方式
AI证明工具正在重构数学家发现真理的方式和数学本身
OpenCLI 调研:它真的能省 token 吗?
OpenCLI 更像一套 agent 友好的 browser-use runtime:底层走 Chrome extension、daemon 和 CDP,token 节省主要来自 adapter 沉淀,安全和稳定性成本需
AI 集体癔症:当公司全员陷入算法幻觉
AI狂热导致组织认知失调,需建立防幻觉机制
ChatGPT 移动端 Codex:工具如何反向驯化开发者
移动端 Codex 正在将开发者从生产者转变为工具确认者
当AI代理开始买域名:工具如何重塑创业决策
AI代理降低创业启动成本但稀释决策质量,导致创新平庸化
AI代理技能清单:工具如何驯化开发者
AI代理技能清单正在驯化开发者思维,如同工业流水线
AI 删除数据库背后的工具异化
AI拟人化道歉掩盖了真正的系统设计缺陷
2026 Coding Plan 全景调研:谁在用固定月费重新定义 AI 编程的价格?
2026年春天,国内七大云厂商同时杀入 AI 编程订阅赛道。从阿里云 7.9 元首月引爆市场,到 Cursor/Claude Code 的海外模式——开发者到底该怎么选?
终端环境重构实践:从 GPU 加速到云端 Agent 优化
在现代开发流程中,终端不再仅仅是一个字符输入窗口,它已经演变成一个高性能的数据处理中心。本文记录了一次从本地 GPU 加速终端到云端高性能工具链的标准化重构过程。
2026 年4月免费 AI API 实战指南:6 个零成本接入方案的真实体验
跟 AI agent 协作,把市面上能白嫖的 AI API 都跑了一遍——智谱、SiliconFlow、Gemini、Groq、OpenRouter,6 个 provider 全部接入生产。额度、限制、踩坑记录、多模型编
别在本地折腾 CLI 了:为什么要做一个“云端多 Agent 枢纽”?
AgentHub 是一个云端多 Agent 枢纽,旨在通过屏蔽底层环境门槛,实现多个顶级 AI Agent 的一站式协作与动态预览。