---
格式版本: 2
标题: "Test-Time Logit Prompting for Source-Free Missing Modality Adaptation"
原文链接: "https://arxiv.org/abs/2609.02039"
发布日期: "2026-09-02"
发布时间校准状态: "found"
发布时间需复核: "否"
发布时间来源: "rule:local:strict_original_body"
发布时间证据: "**\\[v1\\]** Wed, 2 Sep 2026 03:13:06 UTC (1,510 KB)"
发布时间校准原因: "规则确认唯一严格发布时间，来源 local:strict_original_body"
发布时间校准置信度: "high"
发布时间候选数量: 18
发布时间严格候选数量: 6
发布时间原页读取状态: "source template page reused from URL open"
发布时间未找到原因: ""
发布时间校准时间: "2026-09-04T01:38:29+08:00"
发布时间仲裁状态: "skipped"
发布时间仲裁尝试次数: 0
发布时间仲裁耗时毫秒: 0
发现时间: "2026-09-04T01:32:16+08:00"
入库时间: "2026-09-03T17:38:29.612Z"
来源平台: "arXiv 学术论文搜索"
搜索渠道: "source_template"
搜索词: "https://arxiv.org/search/?query=Scale-up&searchtype=all"
匹配关键词:
  - "Scale-up"
  - "deployment"
  - "performance"
  - "AI"
相关厂家:
  []
相关专家:
  []
内容类型: "网页"
抓取工具: "Free Fetch + Defuddle"
清洗工具: "Defuddle Markdown + Defuddle/Readability 正文提取"
原始附件:
  []
AI优质: "否"
AI打分: 15
AI分档: "非优质"
AI质检状态: "不通过"
AI打分理由: "论文内容为视觉语言模型缺失模态适应，与超节点/AI Rack/机柜级AI基础设施完全无关，仅因搜索词命中Scale-up进入，实际无任何相关技术或商业信息。"
AI质检模型: "zj-deepseek-v4-flash"
AI质检时间: "2026-09-04T01:38:53+08:00"
AI主题相关性: 0
AI来源权威性: 10
AI新颖性: 0
AI技术细节: 0
AI商业部署信号: 0
AI完整性: 5
AI摘要: "针对视觉语言模型在测试时遭遇模态缺失的问题，作者提出无需源训练数据的轻量级测试时适应框架TLP，通过不确定性感知调整和模态一致性正则来优化logit提示，在多个视觉语言基准上最高提升8%的识别性能，且仅需数百个可调参数和少量优化步骤。"
AI摘要模型: "ali-deepseek-v4-flash"
AI摘要时间: "2026-09-04T00:17:44.980Z"
采集批次: "2026年9月3日22点43分34秒"
采集批次ID: "20260903-224334-406"
去重键: "https://arxiv.org/abs/2609.02039"
---

## Computer Science > Computer Vision and Pattern Recognition

## Title:Test-Time Logit Prompting for Source-Free Missing Modality Adaptation

Authors:[Taixi Chen](https://arxiv.org/search/cs?searchtype=author&query=Chen,+T), [Nancy Guo](https://arxiv.org/search/cs?searchtype=author&query=Guo,+N)

[View PDF](https://arxiv.org/pdf/2609.02039) [HTML (experimental)](https://arxiv.org/html/2609.02039v1)

> Abstract:Vision-language models (VLMs) have achieved remarkable performance by leveraging complementary information from large-scale image-text pairs. However, missing-modality inputs are commonly encountered during real-world deployment, often leading to significant performance degradation. Existing methods primarily enhance model robustness by learning modality compensation strategies from source training data. However, their reliance on source training data makes them difficult to apply when original data are unavailable due to privacy, storage, or accessibility constraints, such as clinical applications and personalized AI services. This raises an important yet underexplored question: can VLMs be efficiently adapted at test time for visual recognition with missing modalities without accessing source training data? To this end, we propose Test-Time Logit Prompting (TLP), a lightweight source-free test-time adaptation framework for visual recognition with missing modalities. To address missing-induced prediction shifts, TLP optimizes logit prompts with uncertainty-aware adjustment and modality-complete consistency regularization, adaptively adjusting prediction confidence while preserving semantic consistency. Extensive experiments across diverse vision-language benchmarks demonstrate that TLP consistently enhances recognition performance under missing-modality scenarios, achieving up to 8\\% improvements while requiring only hundreds of tunable parameters and a few test-time optimization steps.

| Comments: |  |
| --- | --- |
| Subjects: | Computer Vision and Pattern Recognition (cs.CV) |
| Cite as: | [arXiv:2609.02039](https://arxiv.org/abs/2609.02039) \[cs.CV\] |
|  | (or [arXiv:2609.02039v1](https://arxiv.org/abs/2609.02039v1) \[cs.CV\] for this version) |
|  | [https://doi.org/10.48550/arXiv.2609.02039](https://doi.org/10.48550/arXiv.2609.02039) |

## Submission history

From: Taixi Chen \[[view email](https://arxiv.org/show-email/394055ac/2609.02039)\]  
**\[v1\]** Wed, 2 Sep 2026 03:13:06 UTC (1,510 KB)

[Which authors of this paper are endorsers?](https://arxiv.org/auth/show-endorsers/2609.02039) | Disable MathJax ([What is MathJax?](https://info.arxiv.org/help/mathjax.html))
