首页
学习
活动
专区
工具
TVP
发布
精选内容/技术社群/优惠产品,尽在小程序
立即前往

微软联手北大发布大模型测试基准“PPTC”

据品玩 11 月 6 日报道,微软研究院联手北京大学,共同发布了一款名为 PPTC 的大模型测试基准,可以用于测试大模型在 PPT 生成方面的能力。

研究团队表示,PPTC 包含 279 个涵盖不同主题的多回合会话和数百条涉及多模式操作的说明。研究团队还提出了 PPTX-Match 评估系统,该系统根据预测文件而不是标签 API 序列来评估大语言模型是否完成指令,因此它支持各种 LLM 生成的 API 序列。此外,研究团队表示,当前大语言模型在生成 PPT 内容方面主要存在三个方面的不足,包括多轮会话中的错误累积、长 PPT 模板处理和多模态感知问题。

  • 发表于:
  • 原文链接https://page.om.qq.com/page/OLd7WqPP2TbbY0eOPE3TD2Mg0
  • 腾讯「腾讯云开发者社区」是腾讯内容开放平台帐号(企鹅号)传播渠道之一,根据《腾讯内容开放平台服务协议》转载发布内容。
  • 如有侵权,请联系 cloudcommunity@tencent.com 删除。

相关快讯

扫码

添加站长 进交流群

领取专属 10元无门槛券

私享最新 技术干货

扫码加入开发者社群
领券