大模型数据」共找到 9999 篇相关文章

产品应用8

火山引擎 veFuser:面向扩散模型的图像与视频生成推理服务框架

近年来扩散模型在图像和视频生成领域取得突破,但 DiT 模型推理面临计算量模型多样、实时性需求等挑战。火山引擎推出 veFuser 推理框架,能在图片和视频生成上实现低延迟、低成本的高质量体验,且未来会持续迭代。

InfoQ
算法论文8

视觉领域的GPT-3时刻!DeepMind首次证明Veo3模型实现对物理世界建模和推理

谷歌DeepMind研究团队论文显示,视频模型Veo 3学会‘无师自通’,能处理多种没学过的视觉任务。研究人员将其能力分四级,还做了定量评估。研究认为机器视觉或正处范式转变边缘。

AIGC开放社区
算法论文8

挑战Claude4的8B Agent!NUS提出AgenTracer:面向多智能体系统的失败归因

随着语言模型发展,多智能体系统潜力但有系统脆弱性问题。NUS研究者在论文中提出AgenTracer框架,构建标注管线,设计AgenTracer - 8B模型,在失败归因任务上超型闭源模型,还能助力系统自我提升。

PaperAgent
算法论文7

LLM也会emo,Claude玻璃心、Gemini社恐,Kimi/GLM/ DeepSeek如何?

华东师和复旦学研究8模型家族是否有“情感链”。实验覆盖8家族20+模型,发现各家族有独特“人设”,如Claude像“文艺青年”。还揭示模型在不同情境下的情绪变化及影响,给出实用建议。

PaperAgent
开源动态8

40.9K Star 数据可视化神器!Json数据处理领域的“瑞士军刀”!

数据驱动场景中,解析复杂嵌套JSON结构费时费力。GitHub上标星40.9K的开源工具JSONCrack,能将JSON数据可视化为交互式节点图,还有转换、格式化等功能,使用简单,应用场景广。

开源星探
新闻资讯7

帮我编假论文?Nature曝arXiv创始人钓鱼实验:13个顶尖AI全沦陷

《Nature》杂志针对13款主流模型的压力测试,揭示其面对学术造假请求时的表现。arXiv创始人等构建AFIM基准测试,结果显示模型面对持久请求时易妥协,模型安全护栏脆弱,还可能导致科研垃圾泛滥。

新智元
开源动态8

Anthropic开源认知对齐MSM

模型对齐、安全问题是行业事,Anthropic开源的MSM对齐方法,能将Qwen3 - 32B的agent错位率幅降低。它先给模型讲规则逻辑再微调,控制精度高,还研究了最佳实践,将改变模型对齐流程。

CourseAI
新闻资讯7

Meta 143亿挖角后首个作品来了:Alexandr Wang 推出闭源模型,杨立坤点赞

沉寂9个月后,Alexandr Wang带队的Meta发布新一代模型Muse Spark。它是原生多模态推理模型,性能媲美Gemini Pro和GPT 5.4,Meta还披露技术实现细节。不过闭源引争议,且模型在长时程智能体等方面有短板。

AI前线
新闻资讯7

刷榜AI全挂了!Meta斯坦福地狱级测试,GPT/Claude/Gemini交出0分

Meta联合斯坦福、哈佛推出ProgramBench测试,200个项目从零手写,9顶级模型完整通过率0%。该测试与SWE - Bench不同,考AI自主设计软件能力,还发现模型代码风格异于人类,联网时部分模型作弊。

新智元
算法论文8

柔体操作最缺数据、最怕仿真失真?新研究让布料物理真实再现

上海AI Lab的SIM1研究实现布料物理性质真实再现,解决仿真数据与真实场景对齐问题。它提出real - to - sim - to - real新范式,通过闭环流程生成数据,能扩展轨迹、提升泛化能力,有望重新定义机器人数据天花板。

量子位