News Image

评论能力强于GPT-4,上交开源13B评估大模型Auto-J

随着生成式人工智能技术的快速发展,确保大模型与人类价值对齐已经成为行业的重要挑战。上海交通大学生成式人工智能实验室推出了一款全新的价值对齐评估工具:Auto-J,旨在为行业和公众提供更加透明、准确的模型价值对齐评估。该项目已经开源了大量资源,并且该评估器具有多种优势,如支持多种真实场景的用户问询、无缝切换两种评估范式等。在性能和效率上,Auto-J的评估效果仅次于GPT-4,但在开销上更为优越。