|
| 1 | +package openai |
| 2 | + |
| 3 | +import ( |
| 4 | + "context" |
| 5 | + "testing" |
| 6 | + |
| 7 | + "charm.land/fantasy" |
| 8 | + "github.com/stretchr/testify/require" |
| 9 | +) |
| 10 | + |
| 11 | +// Some OpenAI-compatible backends report cumulative usage on delta |
| 12 | +// chunks and end with a usage-less finish chunk; the last |
| 13 | +// usage-bearing chunk must win. |
| 14 | +func TestStreamUsageSurvivesTrailingUsagelessChunk(t *testing.T) { |
| 15 | + t.Parallel() |
| 16 | + |
| 17 | + server := newStreamingMockServer() |
| 18 | + defer server.close() |
| 19 | + |
| 20 | + server.chunks = []string{ |
| 21 | + `data: {"id":"c1","object":"chat.completion.chunk","created":1,"model":"laguna-xs","choices":[{"index":0,"delta":{"role":"assistant","content":"Hel"},"finish_reason":null}],"usage":{"prompt_tokens":100,"completion_tokens":1,"total_tokens":101}}` + "\n\n", |
| 22 | + `data: {"id":"c1","object":"chat.completion.chunk","created":1,"model":"laguna-xs","choices":[{"index":0,"delta":{"content":"lo"},"finish_reason":null}],"usage":{"prompt_tokens":100,"completion_tokens":5,"total_tokens":105,"prompt_tokens_details":{"cached_tokens":80}}}` + "\n\n", |
| 23 | + `data: {"id":"c1","object":"chat.completion.chunk","created":1,"model":"laguna-xs","choices":[{"index":0,"delta":{},"finish_reason":"stop"}],"usage":null}` + "\n\n", |
| 24 | + "data: [DONE]\n\n", |
| 25 | + } |
| 26 | + |
| 27 | + provider, err := New( |
| 28 | + WithAPIKey("test-api-key"), |
| 29 | + WithBaseURL(server.server.URL), |
| 30 | + ) |
| 31 | + require.NoError(t, err) |
| 32 | + model, err := provider.LanguageModel(t.Context(), "laguna-xs") |
| 33 | + require.NoError(t, err) |
| 34 | + |
| 35 | + stream, err := model.Stream(context.Background(), fantasy.Call{Prompt: testPrompt}) |
| 36 | + require.NoError(t, err) |
| 37 | + |
| 38 | + parts, err := collectStreamParts(stream) |
| 39 | + require.NoError(t, err) |
| 40 | + |
| 41 | + var finish *fantasy.StreamPart |
| 42 | + for i, part := range parts { |
| 43 | + if part.Type == fantasy.StreamPartTypeFinish { |
| 44 | + finish = &parts[i] |
| 45 | + } |
| 46 | + } |
| 47 | + require.NotNil(t, finish) |
| 48 | + require.Equal(t, fantasy.FinishReasonStop, finish.FinishReason) |
| 49 | + // prompt_tokens includes cached tokens; input is reported net of cache. |
| 50 | + require.Equal(t, int64(20), finish.Usage.InputTokens) |
| 51 | + require.Equal(t, int64(80), finish.Usage.CacheReadTokens) |
| 52 | + require.Equal(t, int64(5), finish.Usage.OutputTokens) |
| 53 | + require.Equal(t, int64(105), finish.Usage.TotalTokens) |
| 54 | +} |
| 55 | + |
| 56 | +func TestStreamObjectUsageSurvivesTrailingUsagelessChunk(t *testing.T) { |
| 57 | + t.Parallel() |
| 58 | + |
| 59 | + server := newStreamingMockServer() |
| 60 | + defer server.close() |
| 61 | + |
| 62 | + server.chunks = []string{ |
| 63 | + `data: {"id":"c1","object":"chat.completion.chunk","created":1,"model":"laguna-xs","choices":[{"index":0,"delta":{"role":"assistant","content":"{\"answer\":\"hello\"}"},"finish_reason":null}],"usage":{"prompt_tokens":100,"completion_tokens":5,"total_tokens":105,"prompt_tokens_details":{"cached_tokens":80}}}` + "\n\n", |
| 64 | + `data: {"id":"c1","object":"chat.completion.chunk","created":1,"model":"laguna-xs","choices":[{"index":0,"delta":{},"finish_reason":"stop"}],"usage":null}` + "\n\n", |
| 65 | + "data: [DONE]\n\n", |
| 66 | + } |
| 67 | + |
| 68 | + provider, err := New( |
| 69 | + WithAPIKey("test-api-key"), |
| 70 | + WithBaseURL(server.server.URL), |
| 71 | + ) |
| 72 | + require.NoError(t, err) |
| 73 | + model, err := provider.LanguageModel(t.Context(), "laguna-xs") |
| 74 | + require.NoError(t, err) |
| 75 | + |
| 76 | + stream, err := model.StreamObject(context.Background(), fantasy.ObjectCall{ |
| 77 | + Prompt: testPrompt, |
| 78 | + Schema: fantasy.Schema{ |
| 79 | + Type: "object", |
| 80 | + Properties: map[string]*fantasy.Schema{ |
| 81 | + "answer": {Type: "string"}, |
| 82 | + }, |
| 83 | + Required: []string{"answer"}, |
| 84 | + }, |
| 85 | + }) |
| 86 | + require.NoError(t, err) |
| 87 | + |
| 88 | + parts := collectObjectStreamParts(stream) |
| 89 | + require.NotEmpty(t, parts) |
| 90 | + finish := parts[len(parts)-1] |
| 91 | + require.Equal(t, fantasy.ObjectStreamPartTypeFinish, finish.Type) |
| 92 | + require.Equal(t, int64(20), finish.Usage.InputTokens) |
| 93 | + require.Equal(t, int64(80), finish.Usage.CacheReadTokens) |
| 94 | + require.Equal(t, int64(5), finish.Usage.OutputTokens) |
| 95 | + require.Equal(t, int64(105), finish.Usage.TotalTokens) |
| 96 | +} |
0 commit comments