最新文章
本文介绍 DeepSeek Harness 的核心理念与功能,并从零完成安装配置,实践 Coding、Web Search、Vision 以及第三方模型接入。
系统梳理 2026 年 AI 模型发布中常见的测试平台与 Benchmark:LMArena、Artificial Analysis、LiveBench、SWE-bench、GPQA、HLE、AIME、MMLU、MMMU 等各自测什么、分数怎么读、又不能说明什么。
从 IPv6 反向 DNS 出发,拆解 ip6.arpa 的 nibble 命名方式、前缀与命名空间的对应关系、DNS 委派机制,以及为什么它不适合当普通网站域名。
Cloudflare 在 2026 年 8 月初用一周时间集中发布了 20 多项 Agent 相关功能,覆盖计算、存储、身份、支付和安全。这篇文章整理其中最值得关注的几个方向:Agent 专属浏览器 Kitesurf、持久记忆服务、沙箱隔离环境,以及让 Agent 能独立付款的钱包机制。
Anthropic Claude Code 团队工程总监 Fiona Fung 在 Code w/ Claude SF 2026 上分享了一件反直觉的事:当 AI 把写代码、写测试、重构代码的成本压到接近零后,团队真正慢下来的地方不再是代码——而是评审、所有权和招聘。这篇文章整理了这次分享的核心洞察,以及他们为此重写的一套组织规范。
解读 Anthropic 官方文章讲清 Claude Code 的成本机制:模型选择、输入输出定价差异、Prompt Cache 命中规则,以及一套可以直接照做的省 token 实操清单。
Anthropic 为 Claude Code 推出 /security-review 命令与 GitHub Actions 集成,在终端和 PR 流水线两个层面自动检测 SQL 注入、XSS、认证漏洞、不安全数据处理和依赖漏洞。文章梳理两种用法的工作原理和实际效果,包括 Anthropic 内部的真实数据。
Anthropic 官方梳理了让 Claude Code 会话更高效的九条核心技巧:从 /clear 与 /compact 的使用时机、@-mention 的省 token 逻辑,到 CLAUDE.md 精简策略与"短会话思维",把上下文成本控制的思路讲透。
Anthropic 为 Claude Code 推出自托管环境公测(Team 和 Enterprise 计划):从 claude.ai、移动/桌面端、日程任务发起的云会话,可以跑在你自己网络内的服务器上,而不是 Anthropic 的托管基础设施。代码检出、构建产物、内网服务访问全部留在你的网络边界内。