2026-06-04
微软全新AI图像工具在关键评测中超越谷歌Nano Banana
微软在Build开发者大会上发布了两款新文生图模型——MAI-Image-2.5与Flash版本,同时还推出了首个推理模型MAI-Thinking-1及多款语音、转录和代码模型,共七款新AI模型。根据Arena AI排行...
微软在Build开发者大会上发布了两款新文生图模型——MAI-Image-2.5与Flash版本,同时还推出了首个推理模型MAI-Thinking-1及多款语音、转录和代码模型,共七款新AI模型。根据Arena AI排行...
Anthropic最新发布的Claude Opus 4.8以"更诚实、判断力更强"为核心卖点。作者通过10个精心设计的测试提示,涵盖代码调试、医学引用、保险索赔等场景,对比评估Opus 4.7与4.8的诚实度、准确性和校...
OpenAI发布GPT-5.5,在智能编码、概念理解、科研辅助和知识工作准确性方面均有提升。作者通过十项标准测试对其进行评估,总分100分中GPT-5.5获得93分。失分主要源于模型的"过度热情"——在新闻摘要测试中擅自...