多模态任务」共找到 2683 篇相关文章

产品应用8

百度搜索变天了:怎么搜索你们定

百度 App 搜索框大改版,升级为智能框,支持多模态输入,降低使用门槛。还推出多项功能,如百看、智能创作、深度搜索等,接入 MCP 服务,推动产品能力多方面转变,探索新盈利模式。

MacTalk
算法论文8

TACO: 让 CLI Agent 在自主迭代中学会丢掉无用上下文

由多校及研究团队联合提出 TACO,这是无需训练、即插即用的终端智能体自进化观测压缩框架。它能让智能体学习压缩规则,过滤低价值输出,保留关键线索,实验显示其提升了任务成功率和 token 效率。

机器之心
新闻资讯8

微信测试中心刷新业界标准,斩获 ICCV 图像质量评估挑战赛冠军

微信测试中心IH-VQA团队在ICCV 2025 MIPI赛事夺冠,其首创的iDetex方案刷新业界标准。该方案能精准定位图像失真,提升评估可解释性,已在微信多业务落地,未来将深耕多模态质量评价等领域。

腾讯技术工程
算法论文8

与Gemini Diffusion共振!首个扩散式「发散思维链」来了

西湖大学齐国君教授团队提出扩散式「发散思维链」,这是面向扩散语言模型的新型推理范式。它与传统思维链不同,能非线性生成,已应用于两种模型,增强后的模型在相关任务上超越现有模型。

机器之心
开源动态8

本地Opus你要不要!Qwen3.8-27B开源

阿里Qwen团队开源Qwen3.8-27B,上线2天登顶Hugging Face全球大模型趋势榜,下载破百万。其性能超Opus4.6,与顶尖模型相当,量化后普通电脑就能跑,原生多模态,编程、Agent、多模态跑分表现出色。

AIGC开放社区
产品应用7

腾讯 Hy3 一手实测,Agent 能力提升不止一点

作者拿到 Hy3 模型测试资格,介绍其架构、性能和价格优势,还在 WorkBuddy 里实测它完成运营工作、选编辑助教、开发新功能等任务的效果,最后评价 Hy3 能力、价格、适配方面的表现,并分析 WorkBuddy 领先原因。

特工宇宙
产品应用7

通过逆向工程探秘 Claude Code 背后的运作机制

作者通过逆向工程研究Claude Code内部运作,了解其比Cursor等工具慢且贵的原因。Claude Code注重通用性和安全性,执行任务时多有安全检查,虽增加成本延迟,但更可靠,且在命令行工具中用户体验出色。

宝玉AI
算法论文8

从打分器到思考者:RM-R1用推理重塑模型价值判断

伊利诺伊大学香槟分校团队提出 RM - R1 框架,将奖励建模定义为推理任务。它引入推理奖励模型和链式评估准则机制,经两阶段训练,在多基准测试中表现超大规模模型,验证了推理能力对奖励模型的重要性。

机器之心
推荐文章7

上下文工程又进化了:Harness实现AI完全自主化

近期Harness Engineering讨论火热,Harness是围绕AI模型的支撑架构,Anthropic用其突破AI局限,解决AI完成复杂任务时的偷懒问题,还通过多智能体架构用于前端设计、软件开发,经实战检验效果良好,后续还对其进行简化。

AIGC开放社区
新闻资讯7

AI开始替人类调用AI!token用量已是人类5.2倍

据OpenRouter统计,截至8月10日,Agent类token用量半年涨14倍,人类仅2.8倍。差距源于用法差异,虽智能体部分token计价低,但用量大仍烧钱。省钱关键在配套,且智能体任务验收缺人手。

新智元