LLM微调库」共找到 1420 篇相关文章

算法论文8

告别“一眼定生死”:Agent-as-a-Judge 开启 AI 评估的下半场

过去两年,LLM-as-a-Judge成评估界“黄金标准”,但面对复杂任务力不从心。论文《A Survey on Agent-as-a-Judge》指出,应从单一的大模型裁判进化为具备行动能力的智能体裁判,还阐述了其优势、发展阶段等。

深度学习自然语言处理
新闻资讯7

印裔1号位删 Karpathy 团队90%代码、算力暴涨 50 倍!马斯克 Robotaxi 10年终上线,30 元乘车体验刷屏

当地时间6月22日,特斯拉在奥斯汀启动Robotaxi试点服务,仅受邀用户参与。其技术基于FSD 13.2.9微调,团队精简90%代码,算力强大。虽面临竞争,但马斯克看好其发展,认为2026年或现超级智能。

AI前线
开源动态8

清华开源|做一门课要3天?用 OpenMAIC,30分钟生成完整互动课堂|GitHub 15.6k

OpenMAIC 是清华开源的 AI 互动课堂平台,能将主题或学习材料快速转化为完整互动学习体验。它把课堂拆成多种交互组件,架构设计出色,支持多 LLM 服务商,还能在聊天应用生成课堂。

小华同学ai
新闻资讯7

65岁LeCun被卷回巴黎老家!与小扎一刀两断,曝光神秘AI初创

65岁的图灵奖得主Yann LeCun年底将离开Meta创业,其新公司专注高级机器智能,教AI理解物理世界。他批评LLM触及天花板,是AI黑洞,多年来坚持世界模型研究,认为其才是通向真正智能之路。

新智元
算法论文8

小模型才是 Agent 的未来?这篇立场文把话挑明了

AI Agent浪潮来袭,主流用LLM构建,但英伟达和佐治亚理工学院研究人员论文指出,多数Agent场景中,小语言模型(SLM)已足够强、更好管、更省钱,还给出迁移清单、避坑建议和参考系统形态。

AI寒武纪
算法论文8

ICRA 2025|通用多机器人长时任务规划框架破解任务分配难题,成功率+105%、效率+36%

2025年5月,美两校联合团队在ICRA 2025发布LaMMA - P。它融合大模型与PDDL规划器,解决异构多机器人长时任务分配难题,在新基准数据集上,相比SMART - LLM,任务成功率提高105%,执行效率提升36%。

机器之心
开源动态8

开源屠刀!400美元炼成「代码副脑」,硅谷天价模型成废铁

AI2开源Open Coding Agents,以最低数百美元算力成本,能训练贴合私有代码的专属编程智能体。SERA-32B表现惊艳,其软验证生成技术降低成本,新代码易部署且兼容Claude Code。

新智元
开源动态7

这个开源模型的UI审美碉堡了~

当下流行基于大模型生成HTML源码可视化文本内容,网页审美对模型很难。早期用Claude 3.7,后有DeepSeek V3 0324等。Tesslate开源基于Qwen微调的模型,尺寸全,审美佳,想象空间大。

探索AGI
算法论文8

跨层压缩隐藏状态同时加速TTFT和压缩KV cache!

论文 UNCOMP 被 EMNLP 2025 主会接收,提出高效推理框架,用截断矩阵熵解释 LLM 稀疏化,据此设计 UNCOMP 框架,通过压缩隐藏状态优化 KV Cache,实现计算与内存联合优化,实验效果显著。

机器之心
开源动态8

刚刚,北大&360里程碑式突破!32B安全分碾压千亿巨兽

2025年9月23日,北大 - 360联合实验室发布TinyR1 - 32B模型,仅用20k数据微调就实现安全性能突破,兼顾推理与通用能力。还推出TinyR1 - Safety - 8B,且系列模型已全面开源。

新智元