跨任务自适应」共找到 2309 篇相关文章

算法论文8

Tilelang-1: Introduction

文章围绕TileLang展开,指出高层框架抽象层次高,难以满足算法创新和精细控制需求。TileLang将数据流与调度解耦,在易用性和性能间取得平衡。通过实例展示其语法和编译流程,实验表明它在多任务上超越现有方法。

GiantPandaLLM
算法论文7

少说‘Wait’,多做题:NoWait重塑大模型推理路径

现代大模型在复杂推理时爱用自我反思词,触发冗余验证循环,拖慢速度、增加算力消耗。NoWait方法零训练成本,通过抓关键词、扩展变体、实时屏蔽,让模型跳过废话,在多任务中表现出色,且颠覆对推理的认知。

深度学习自然语言处理
产品应用8

文库 GenFlow 2.0,如何把 AI Agent 卷成“专家级”?

百度启动文库与网盘AI重构工程,8月18日GenFlow2.0发布。它生成的报告格式专业,能让用户实时干预任务运行,HTML在线报告交付体验好。其靠100多个专家Agent工作,构建了清晰产品层次和分层策略。

特工宇宙
推荐文章8

Devin 教你做 Agent:把 AI 当做需要指导的初级开发者

Cognition团队发布编程智能体实践指南,以把AI当初级开发者的心智模型为基础。介绍与智能体沟通原则及融入日常工作流的场景,还分初、中、高级给出任务处理方法,也提及局限性、使用建议和安全管理等内容。

Founder Park
开源动态7

感谢 OpenClaw,国产大模型终于知道怎么挣钱了

OpenClaw作为免费开源项目,重新定义Token消耗量级,催生‘超级Token耗散场景’,倒逼模型厂商推出‘Token Plan’。多家国产模型厂商跟进推出‘龙虾套餐’,云平台也下场布局。但OpenClaw面临配置门槛、任务稳定性和必用场景等问题。

Founder Park
新闻资讯8

全球首个科研LLM竞技场上线!23款顶尖模型火拼:o3夺冠,DeepSeek第四

Ai2耶鲁NYU联合推出科研版「Chatbot Arena」——SciArena,23款顶尖大模型比拼科研任务,OpenAI o3夺冠,DeepSeek第四。该平台解决通用基准测试在科研场景‘失效’问题,但其自动评估系统猜科研人偏好远未及格。

新智元
开源动态7

GPT-5得分不到0.4!法律+金融最大规模基准:1.9万+专家评估准则

新推出的PRBench基准可测AI在金融和法律领域表现。它有19356条专家评估准则,是该领域最大公开基准。顶尖大模型在困难子集得分低,还独创经济路径分析维度,约30%任务为多轮对话,揭示了AI在专业领域的不足。

新智元
新闻资讯8

LLM近期重大架构进化一览:从Gemma 4到DeepSeek V4

近期大模型长上下文需求增长,成本问题凸显。Google Gemma 4、Poolside Laguna XS.2、Zyphra ZAYA1 - 8B、DeepSeek V4 等模型各有架构优化,如 Gemma 4 层 KV 共享和 PLE,以降低长上下文推理成本。

机器之心
算法论文8

谷歌助力神经科学飞跃,破解斑马鱼全脑活动密码

谷歌等机构科学家联合发布开创性研究成果ZAPBench,这是预测斑马鱼全脑活动的基准测试平台。它含超70000个神经元4D光片显微镜记录,设计多种刺激条件采集数据,有特定基准测试任务和评估指标。

AIGC开放社区
算法论文8

AI Agents和Agentic AI有什么区别?

论文《AI Agents vs. Agentic AI》深入探讨AI Agent和Agentic AI的本质差异。AI Agents是集成大模型和外部工具的单体系统,适合简单任务;Agentic AI是多智能体协作新范式,适合复杂场景。还提及挑战、解决方案与未来方向。

AGI Hunt