子空间级别微调方法CS-ReFT,能够让7B的Llama-2在AlpacaEval中超过GPT-3.5,同行评审7/6/7; 大模型安全漏洞检测框架Siege,针对GPT-3.5-Turbo的检测准确率为100%,审稿人打分7/7。
两篇论文入选ICLR
让7B Llama-2超越GPT-3.5
发现大模型安全漏洞
预测蛋白质-核酸结合位点
多智能体协作完成科研流程
文献分析和知识综合; 假设生成和细化,确定研究方向; 实验设计和实施、评估; 数据分析和解释以及科学交流。
“AI科研”仍然争议不断
