2026-02-17 10:33:25 +09:00
|
|
|
/// <reference types="bun-types" />
|
|
|
|
|
|
|
|
|
|
import { describe, expect, it, afterEach } from "bun:test"
|
|
|
|
|
|
|
|
|
|
import { getContextWindowUsage } from "./dynamic-truncator"
|
|
|
|
|
|
|
|
|
|
const ANTHROPIC_CONTEXT_ENV_KEY = "ANTHROPIC_1M_CONTEXT"
|
|
|
|
|
const VERTEX_CONTEXT_ENV_KEY = "VERTEX_ANTHROPIC_1M_CONTEXT"
|
|
|
|
|
|
|
|
|
|
const originalAnthropicContextEnv = process.env[ANTHROPIC_CONTEXT_ENV_KEY]
|
|
|
|
|
const originalVertexContextEnv = process.env[VERTEX_CONTEXT_ENV_KEY]
|
|
|
|
|
|
|
|
|
|
function resetContextLimitEnv(): void {
|
|
|
|
|
if (originalAnthropicContextEnv === undefined) {
|
|
|
|
|
delete process.env[ANTHROPIC_CONTEXT_ENV_KEY]
|
|
|
|
|
} else {
|
|
|
|
|
process.env[ANTHROPIC_CONTEXT_ENV_KEY] = originalAnthropicContextEnv
|
|
|
|
|
}
|
|
|
|
|
|
|
|
|
|
if (originalVertexContextEnv === undefined) {
|
|
|
|
|
delete process.env[VERTEX_CONTEXT_ENV_KEY]
|
|
|
|
|
} else {
|
|
|
|
|
process.env[VERTEX_CONTEXT_ENV_KEY] = originalVertexContextEnv
|
|
|
|
|
}
|
|
|
|
|
}
|
|
|
|
|
|
2026-03-08 02:10:48 +09:00
|
|
|
function createContextUsageMockContext(
|
|
|
|
|
inputTokens: number,
|
|
|
|
|
options?: { providerID?: string; modelID?: string; cacheRead?: number }
|
|
|
|
|
) {
|
2026-02-17 10:33:25 +09:00
|
|
|
return {
|
|
|
|
|
client: {
|
|
|
|
|
session: {
|
|
|
|
|
messages: async () => ({
|
|
|
|
|
data: [
|
|
|
|
|
{
|
|
|
|
|
info: {
|
|
|
|
|
role: "assistant",
|
2026-03-08 02:10:48 +09:00
|
|
|
providerID: options?.providerID ?? "anthropic",
|
|
|
|
|
modelID: options?.modelID,
|
2026-02-17 10:33:25 +09:00
|
|
|
tokens: {
|
|
|
|
|
input: inputTokens,
|
|
|
|
|
output: 0,
|
|
|
|
|
reasoning: 0,
|
2026-03-08 02:10:48 +09:00
|
|
|
cache: { read: options?.cacheRead ?? 0, write: 0 },
|
2026-02-17 10:33:25 +09:00
|
|
|
},
|
|
|
|
|
},
|
|
|
|
|
},
|
|
|
|
|
],
|
|
|
|
|
}),
|
|
|
|
|
},
|
|
|
|
|
},
|
|
|
|
|
}
|
|
|
|
|
}
|
|
|
|
|
|
|
|
|
|
describe("getContextWindowUsage", () => {
|
|
|
|
|
afterEach(() => {
|
|
|
|
|
resetContextLimitEnv()
|
|
|
|
|
})
|
|
|
|
|
|
|
|
|
|
it("uses 1M limit when model cache flag is enabled", async () => {
|
|
|
|
|
//#given
|
|
|
|
|
delete process.env[ANTHROPIC_CONTEXT_ENV_KEY]
|
|
|
|
|
delete process.env[VERTEX_CONTEXT_ENV_KEY]
|
|
|
|
|
const ctx = createContextUsageMockContext(300000)
|
|
|
|
|
|
|
|
|
|
//#when
|
2026-02-17 10:45:48 +09:00
|
|
|
const usage = await getContextWindowUsage(ctx as never, "ses_1m_flag", {
|
|
|
|
|
anthropicContext1MEnabled: true,
|
|
|
|
|
})
|
2026-02-17 10:33:25 +09:00
|
|
|
|
|
|
|
|
//#then
|
|
|
|
|
expect(usage?.usagePercentage).toBe(0.3)
|
|
|
|
|
expect(usage?.remainingTokens).toBe(700000)
|
|
|
|
|
})
|
|
|
|
|
|
|
|
|
|
it("uses 200K limit when model cache flag is disabled and env vars are unset", async () => {
|
|
|
|
|
//#given
|
|
|
|
|
delete process.env[ANTHROPIC_CONTEXT_ENV_KEY]
|
|
|
|
|
delete process.env[VERTEX_CONTEXT_ENV_KEY]
|
|
|
|
|
const ctx = createContextUsageMockContext(150000)
|
|
|
|
|
|
|
|
|
|
//#when
|
2026-02-17 10:45:48 +09:00
|
|
|
const usage = await getContextWindowUsage(ctx as never, "ses_default", {
|
|
|
|
|
anthropicContext1MEnabled: false,
|
|
|
|
|
})
|
2026-02-17 10:33:25 +09:00
|
|
|
|
|
|
|
|
//#then
|
|
|
|
|
expect(usage?.usagePercentage).toBe(0.75)
|
|
|
|
|
expect(usage?.remainingTokens).toBe(50000)
|
|
|
|
|
})
|
|
|
|
|
|
|
|
|
|
it("keeps env var fallback when model cache flag is disabled", async () => {
|
|
|
|
|
//#given
|
|
|
|
|
process.env[ANTHROPIC_CONTEXT_ENV_KEY] = "true"
|
|
|
|
|
const ctx = createContextUsageMockContext(300000)
|
|
|
|
|
|
|
|
|
|
//#when
|
2026-02-17 10:45:48 +09:00
|
|
|
const usage = await getContextWindowUsage(ctx as never, "ses_env_fallback", {
|
|
|
|
|
anthropicContext1MEnabled: false,
|
|
|
|
|
})
|
2026-02-17 10:33:25 +09:00
|
|
|
|
|
|
|
|
//#then
|
|
|
|
|
expect(usage?.usagePercentage).toBe(0.3)
|
|
|
|
|
expect(usage?.remainingTokens).toBe(700000)
|
|
|
|
|
})
|
2026-03-08 02:10:48 +09:00
|
|
|
|
|
|
|
|
it("uses model-specific limit for non-anthropic providers when cached", async () => {
|
|
|
|
|
// given
|
|
|
|
|
const modelContextLimitsCache = new Map<string, number>()
|
|
|
|
|
modelContextLimitsCache.set("opencode/kimi-k2.5-free", 262144)
|
|
|
|
|
const ctx = createContextUsageMockContext(180000, {
|
|
|
|
|
providerID: "opencode",
|
|
|
|
|
modelID: "kimi-k2.5-free",
|
|
|
|
|
})
|
|
|
|
|
|
|
|
|
|
// when
|
|
|
|
|
const usage = await getContextWindowUsage(ctx as never, "ses_model_limit", {
|
|
|
|
|
anthropicContext1MEnabled: false,
|
|
|
|
|
modelContextLimitsCache,
|
|
|
|
|
})
|
|
|
|
|
|
|
|
|
|
// then
|
|
|
|
|
expect(usage?.usagePercentage).toBeCloseTo(180000 / 262144)
|
|
|
|
|
expect(usage?.remainingTokens).toBe(82144)
|
|
|
|
|
})
|
2026-02-17 10:33:25 +09:00
|
|
|
})
|