2025-10-27
生成式AI使用文本图像而非纯文本作为Token的惊人创新
研究人员提出一种颠覆传统的AI设计思路:将输入文本先转换为图像,再送入AI处理,而非直接使用纯文本。这种方法基于标记化压缩的需求,因为当前大语言模型受限于标记数量限制。实验显示,通过图像压缩可实现10倍压缩率,精度达96...
研究人员提出一种颠覆传统的AI设计思路:将输入文本先转换为图像,再送入AI处理,而非直接使用纯文本。这种方法基于标记化压缩的需求,因为当前大语言模型受限于标记数量限制。实验显示,通过图像压缩可实现10倍压缩率,精度达96...
加拿大AI公司Cohere发布了Command A Vision视觉模型,专门针对企业应用场景。该模型拥有1120亿参数,仅需两个GPU即可运行,能够处理图表、图形、扫描文档和PDF等企业常见视觉数据。在九项基准测试中,...
周四,法国大型语言模型(LLM)开发商Mistral推出了一款新API,专为处理复杂PDF文档的开发者设计。Mistral OCR是一种光学字符识别(OCR)API,可以将任何PDF转换为文本文件,以便AI模型更容易地进...