长上下文任务」共找到 2874 篇相关文章

产品应用8

巧妙!一个传统技术让国产视觉基础模型直接上大分

格灵深瞳的Glint - MVT视觉基础模型表现出色,线性探测准确率高于CLIP等,下游任务效果佳。其引入间隔Softmax损失函数,结合虚拟类别构造等优化方案提升性能,团队专注视觉研发,务实开放。

量子位
产品应用7

本地/云电脑双模式,豆包来了!

黄叔实测豆包「工作任务」模式,其有独特的本地/云电脑双模式。本地能分析电脑内存问题,云端可处理监控任务,还能助力开发复杂项目,且Skill自动接入,与本地电脑实时同步。

AI产品黄叔
开源动态8

不安全指令,一拒了之?TRIAD用三路决策:修复AI智能体的危险计划

墨尔本大学团队开源TRIAD框架,将传统二元护栏决策扩展为继续、更新、拒绝三类。通过自然语言反馈引导Agent修正计划,在ASB和AgentHarm评测中,显著降低攻击成功率,提升正常任务完成率。

新智元
产品应用7

Claude杀入Office全家桶,全球4.5亿打工人一夜变天!OpenAI惨烈出局

微软推出办公神器Copilot Cowork,全面接管Office。它内置Claude模型,能执行任务、运行工作流,可处理日程、会议准备等场景。微软采用多模型策略,抛弃OpenAI,Copilot Cowork适合企业,价格较高。

新智元
开源动态8

AAAI 2026 Oral|InfiGUI-G1模型来了,刷新GUI Grounding SOTA

多模态大语言模型发展下,GUI Grounding任务是难题,现有RLVR方法有瓶颈。浙江大学等团队提出AEPO框架,推出InfiGUI - G1系列模型,小参数量刷新GUI基准测试SOTA,代码已开源。

机器之心
产品应用8

字节豆包2.0重磅发布!成本暴降一个数量级,Seed团队揭秘视频Agent竞争关键

今日字节发布豆包大模型2.0系列,围绕大规模生产环境需求优化,有Pro、Lite、Mini和Code四款模型。其Token单价低一个数量级,多模态理解能力升级,未来将围绕链路智能系统构建发展。

InfoQ
产品应用8

马斯克挖不动的清华学霸,一年造出 “反内卷 AI”!0.27B参数硬刚思维链模型,推理完爆o3-mini-high

新加坡Sapient Intelligence推出小参数AI模型HRM,能解决复杂推理难题。它受大脑启发,提出“隐性推理”路径,准确率碾压先进思维链模型,推理能力超越o3 - mini - high,经济性突出,任务效率可百倍提升。

AI前线
新闻资讯7

一个跑智能体,一个专门找漏洞:Google发布Gemini 3.8双版本

9月2日,Google发布Gemini 3.8 Flash和Gemini 3.8 Flash Cyber。前者用于编程等,已稳定上线;后者专用于发现修复漏洞,仅向特定方开放。二者共享基础能力,采用不同安全限制和部署环境。

AIGC开放社区
推荐文章7

AI Coding 流畅度模型:人机协作中的开发者角色转型与未来演进

生成式 AI 正进入软件开发流程,角色不断扩大。AI Coding Fluency 模型描述团队使用 AI 能力演进,从辅助到自主执行。AI 编程面临信任、上下文任务设计挑战,关键在于协作方式。

phodal
产品应用7

Github 7万星的Clawdbot实测:用国产模型做心脏,躺在床上指挥电脑干活。

本文实测了Github 7万星的Clawdbot(现叫Moltbot),介绍其能在本地运行,可多平台交互,有持久记忆、能控制浏览器等特点,还说明了安装配置过程,指出它虽有不足但想象空间大。

AI进修生