Hugging Face·· 2024-12-05AI 评分49
大语言模型自我纠错能力如何?基于 Keras 与 TPU 的 Chatbot Arena 实验
How good are LLMs at fixing their mistakes? A chatbot arena experiment with Keras and TPUs
AI 导读
该实验基于 Keras、JAX 与 TPU v5e 构建了 Chatbot Arena 对比环境,测试 10B 参数量以下大语言模型在自然语言提示下修正代码错误的能力。系统利用拥有 8 个核心、共 128GB 内存的 TPU v5e 进行模型分片,以 bfloat16 格式在显存中同时加载多个约 8B 与 2B 参数模型进行即时对话评测。
来源:Hugging Face · huggingface.co