Gemini LVM Bug #501

Open
opened 2026-02-16 00:18:03 -05:00 by yindo · 0 comments
Owner

Originally created by @TLTP1995 on GitHub (Jul 6, 2025).

When running Llamaparse with LVM Gemini-2.0-Flash, the model in many cases (about 1/3) starts filling the parsed output with either long set of blanks or random long sequence of random letters such as:

0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0

This severely prolongs the parsing, increases the output cost and polutes the outcome. Would be nice to have a solution for this, or at least a way to limit it by setting for example the maximum token output per page.

Originally created by @TLTP1995 on GitHub (Jul 6, 2025). When running Llamaparse with LVM Gemini-2.0-Flash, the model in many cases (about 1/3) starts filling the parsed output with either long set of blanks or random long sequence of random letters such as: 0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0gQJ0gQ0gQJ0gQJ0 This severely prolongs the parsing, increases the output cost and polutes the outcome. Would be nice to have a solution for this, or at least a way to limit it by setting for example the maximum token output per page.
yindo added the bug label 2026-02-16 00:18:03 -05:00
Sign in to join this conversation.
1 Participants
Notifications
Due Date
No due date set.
Dependencies

No dependencies set.

Reference: run-llama/llama_cloud_services#501