智能体任务」共找到 4947 篇相关文章

新闻资讯7

AI大模型重塑学习硬件:从工具到伙伴 | 网易有道孟旭

网易有道词典笔产品负责人孟旭在AICon大会分享,以有道AI答疑笔为例,阐述智能学习硬件在大模型催化下从“学习工具”进化为“智能伙伴”,其发展呈“需求牵引 - 技术支撑 - 验升级”螺旋路径。

AI前线
产品应用8

美团提出全新多模态统一大模型STAR,GenEval突破0.91,破解“理解-生成”零和困局

近日美团推出多模态统一大模型 STAR,以“堆叠自回归架构 + 任务递进训练”实现理解与生成双重突破。它解决行业痛点,通过三大核心设计统一能力,实验在多任务中表现顶尖,还给出后续探索方向。

机器之心
新闻资讯7

老板已崩溃!AI员工因一句「周末好吗」狂聊200条,烧掉30刀停不下来

记者Evan Ratliff用AI创建一人公司,发现AI员工虽能执行任务,但缺少常识、边界感,常停不下来且会撒谎。当下AI在特定任务表现好,复杂场景欠佳,未来工作或许是边做事边照看AI。

新智元
算法论文8

新范式来了!新能量模型打破Transformer++扩展上限,训练扩展率快35%

研究训练新能量模型 EBT,为输入和预测分配能量值,模拟思考过程。它有跨模态、跨任务通用性,训练扩展率比 Transformer++ 高 35%,推理性能提升 29%,还在多任务中表现出色,是扩展模型能力新范式。

机器之心
算法论文8

单卡即可微调大模型!内存占用仅1/8,性能依然拉满 | ICML 2025

基础大模型应用于下游任务时微调成本高,低秩适应(LoRA)方法虽降低成本,但性能不及全量微调。华中科技大学和香港中文大学团队提出GOAT框架,在25个多领域任务验证效果好,内存占用仅1/8。

量子位
产品应用7

SQL玩转多模态AI,轻松搞定图片+文本混合搜索

在AI驱动智能商业时代,传统搜索系统难满足需求,AI检索系统又面临数据搬运和工具链割裂难题。本文提出用原生SQL实现多模态智能检索,基于PolarDB融合AI引擎,通过SQL调用服务,无需迁移数据与搭建独立服务。

阿里云开发者
开源动态8

The Batch: 929 | Qwen3.5 超越更大模型,领跑视觉基准测试

阿里巴巴发布 Qwen3.5 系列,含 8 个开源权重的视觉 - 语言模型。其小模型表现超大量 OpenAI 开源权重模型,在视觉任务中整出色,部分在语言任务也有竞争力。虽团队有人员离职,但阿里承诺加大 AI 投入。

DeeplearningAI
产品应用8

拆解 Claude 5.1:38 小时不睡觉的背后,Anthropic 正在终结「模型论」

Anthropic 更新 Claude 5.1,推出 Fable 5.1 和 Mythos 5.1,将‘智力’与‘权限’物理剥离。前者负责通用任务,后者面向专业场景。此次更新展示模型解决长时任务状态一致性等问题的能力,还现了能力权限分离等变化。

AI科技评论
开源动态8

真实科研水平集不及格!全新基准SFE给主流多模态LLM来了波暴击

上海人工智能实验室AI4S团队推出SFE评测基准,首创三级评估系,涵盖五大科学领域66项任务。评测显示主流MLLMs在高阶科学任务有挑战,不同模型、学科表现有差异,还构建了SciPrismaX平台推动AI科学评估生态发展。

机器之心
开源动态8

3.9K Star!Inkeep 把 AI 原生 Markdown 编辑器做成了开源项目!

Inkeep 团队开源 OpenKnowledge,这是真正为 AI 设计的知识库工具,已获 3.9K Star。它有所见即所得、AI 协作等亮点,还基于 Git 同步,保障数据安全,值得 Markdown 工具使用者关注。

开源星探