智谱 AI 开源视觉语言模型 CogAgent 支持GUI图形界面问答
智谱AI开源了CogAgent,它是一个视觉语言模型,拥有180亿参数规模。该模型在GUI理解和导航方面表现出色,在多个基准测试上取得了SOTA的通用性能。CogAgent还支持OCR相关任务,通过预训练和微调,其能力得到了显著提升。
AI图形设计工具Recraft完成1200万美元A轮融资,将构建自有基础模型
AI生成图像在世界各地引发争议,即便AI生成图像在选举中的使用在本周世界经济论坛上引起了关注,初创公司仍在推动为创作者提供的AI工具领域不断前行。Recraft作为一款面向专业人士的AI图形设计生成器,已完成由硅谷KhoslaVentures领投的1200万美元A轮融资,前GitHub首席执行官NatFriedman也参与了投资。同样的人能够在同一本书中使用更加美丽的插图和图像。