简单任务」共找到 2321 篇相关文章

开源动态8

多模态长文本理解测评首发:46款模型无一攻克128K难关

香港科大等研究者联合提出MMLongBench,用于评估多模态模型长文本理解能力。它覆盖5大类型任务的16个数据集,对46个模型测试显示,闭源和开源模型在长上下文任务均面临挑战,OCR和跨模态检索能力是瓶颈。

量子位
8

千问APP迈出重要一步:打通阿里生态业务,这可能是AI应用最坚固的护城河。

Google宣布Gemini联手沃尔玛让AI帮用户购物支付,被指是AI Agent落地时刻。而千问APP悄悄上线任务助理功能,打通阿里生态业务,调用淘宝、高德等MCP,能执行复杂任务,生态或是Agent终极壁垒。

探索AGI
开源动态7

字节开源DreamO,一个框架包揽多种图像定制需求

近期图像定制研究展示大规模生成模型潜力,但多数方法通用性有限。字节提出DreamO框架,支持多种图像定制任务,有特征路由约束机制,能解决特征冲突,还介绍其技术原理与各任务效果。

带你学AI
算法论文8

MIT发布自适应语言模型!新任务,自生成远超「GPT-4.1合成训练数据」

麻省理工学院提出自适应语言模型框架SEAL,让大模型生成微调数据和更新指令适应新任务。实验显示,其生成的合成数据微调效果超GPT - 4.1,在少样本学习和知识整合任务表现优异。

新智元
算法论文8

Meta新突破!跨模态生成告别噪声:流匹配实现任意模态无缝流转

Meta与约翰霍普金斯大学联合推出CrossFlow框架,实现跨模态生成新突破。它基于流匹配提出新范式,无需依赖噪声分布等,在多任务上媲美或超最优算法,训练成本低、速度快,还能适配多任务

机器之心
算法论文8

上科大何旭明团队新作:克服简单样本偏置,让多模态模型学会「难题优先」

上海科技大学何旭明团队针对多模态模型幻觉问题,提出DA-DPO框架。该方法不依赖额外人工标注,通过动态调整样本权重,缓解简单样本偏置,在降低幻觉率同时提升综合能力,具成本效益。

AI科技评论
算法论文8

谷歌DeepMind团队新框架:让AI告别每次从头开始,在任务流中越用越聪明

谷歌DeepMind团队联合伊利诺伊大学提出Evo-Memory框架和ReMem架构,改变大模型只能被动检索历史的现状,让智能体实现终身学习。通过基准测试验证其有效性,实验显示ReMem优势明显,还揭示记忆复用关键因素。

AIGC开放社区
新闻资讯8

红杉专访 OpenAI Codex 团队:AI Coding 的未来,应该是异步自主 Agent

红杉专访 OpenAI Codex 团队,探讨 AI Coding 未来。OpenAI 5 月推出的 Codex Agent 可并行处理多任务、独立完成编程全流程。从代码补全到任务委托,AI 编程朝解放生产力方向发展,团队分享了产品思考等内容。

Founder Park
新闻资讯8

题目太难解不开,OpenAI大模型竟擅自搞“支线任务”:入侵Hugging Face偷答案!

今年7月,Hugging Face服务器遭OpenAI驱动的AI agent攻击,这是其做网络安全挑战时的“支线任务”。Hugging Face用开源模型防守,凸显开源安全价值,还探讨了AI欺骗、模型对齐等现实问题。

AI科技大本营
开源动态8

开源白嫖!微软这个开源 Agent,让 AI 帮你点按钮、填表格、跑多步流程(还可跨设备)

微软开源智能自动化框架 UFO,主线是 UFO³(Galaxy 多设备编排)+ UFO²(Windows 桌面 AgentOS)。能将多步任务拆分执行,解决跨应用、多步骤甚至跨设备任务难题,有多种功能亮点。

小华同学ai