合成文本数据」共找到 2934 篇相关文章

新闻资讯7

GPT-5仅23.3%,全球AI集体挂科!地狱级编程考试,夺金神话破灭

最新基准测试SWE-Bench Pro评估AI编程智能体,直面真实企业级工程任务。顶尖模型几乎溃败,GPT - 5仅23.3%。该测试解决现有基准数据污染、任务简单问题,能成未来LLM编码能力标尺。

新智元
产品应用7

Marble登场!告别不稳定与变形,持久探索3D世界

李飞飞团队World Labs推出Marble并开放有限测试预览,基于图像或文本提示可生成3D世界,具有持久、稳定、风格多样等特点。用户能导出使用,在浏览器自由导航,虽有局限但潜力大。

带你学AI
产品应用8

AI时代,企业微信5.0的实用主义答卷 | 甲子光年

在AI浪潮下,企业微信5.0于8月20日发布,未推‘无所不能’的AI Agent,而是将AI融入搜索、总结、问答、表格等高频办公场景,解决数据孤岛,赋能内外协作,以实用主义破企业级AI落地难题。

甲子光年
开源动态8

字节Seed团队发布循环语言模型Ouro,在预训练阶段直接「思考」,Bengio署名

现代LLM依赖显式文本生成训练“思考”,未充分挖掘预训练数据潜力。字节Seed团队联合多家机构推出循环语言模型Ouro,将推理能力构建到预训练阶段,实现参数效率提升,还降低了有害性。

机器之心
算法论文8

当 AI 下场炒 A 股,「推理」成了新的直觉

海外“AI Trading Battle”实验中,不同大模型交易表现差异大。港科大等团队提出RETuning方法,基于A股数据集验证,显著提升大模型金融预测准确率、推理可解释性,是综合改进方案,但有算力等局限。

AI科技评论
推荐文章8

AI三问:Agent、LLM、RAG,一文厘清!

文章介绍大语言模型(LLM)、检索增强生成(RAG)和AI智能体(Agent)三种架构。阐述其概念、工作原理、应用场景、优缺点,还做了横向对比,给出选用建议,最后提及混合架构与未来趋势。

MCP Lab
产品应用8

关于 AI Agent,「实在」、「好用」可能比「颠覆」更重要

8月18日百度AI Day上,百度文库、网盘联合发布全端通用Agent「GenFlow2.0」。它无需邀请码,多专家协助,能利用文库和网盘数据,实测在多场景表现超预期,稳定高效,“好用”才是关键。

刘言飞语
算法论文8

ICCV 2025|UV-CoT:无监督视觉推理新突破,偏好优化重塑图像级思维链

随着文本领域思维链推理机制成功应用,研究者将其引入视觉理解任务。现有模型有局限,本文提出UV - CoT新框架,设计无监督数据生成与偏好优化机制,提升模型能力,摆脱对人工标注依赖。

机器之心
算法论文8

奖励模型也能Scaling!上海AI Lab突破强化学习短板,提出策略判别学习新范式

上海人工智能实验室提出策略判别学习(POLAR)新范式,解决奖励模型设计与训练瓶颈。POLAR可灵活适配多样需求,弥补传统奖励模型短板,契合强化微调框架,实验证明其性能和泛化性优越。

量子位
新闻资讯8

刷新硅谷融资纪录!华人具身智能团队刚毕业融资过7亿元,平均年龄不到28岁

华人主导的Genesis AI公司成立仅一月完成1.05亿美元种子轮融资,刷新硅谷两项融资纪录。团队平均年龄不到28岁,靠开源的Genesis物理引擎吸引投资,致力于开发通用机器人基础模型和通用机器人。

量子位