「美学表现」共找到 2253 篇相关文章
Loop-ViT:让AI学会「反复思考」,3.8M参数小模型追平人类平均水平
香港科技大学等团队提出 Loop - ViT,将循环 Transformer 引入视觉推理领域。该模型参数少但性能强,3.8M 小版本追平人类平均水平,揭示视觉推理任务中‘思考时间’比‘模型大小’更重要。
让记忆学会“进化”:探索 LLM Agent 的运行时价值感知与自适应检索 | 直播预约
本次直播将介绍最新研究成果 MemRL,提出作用于情景记忆的运行时强化学习方法,使 LLM Agent 能判断记忆价值,检索高价值经验,提升复杂未知环境下泛化性能与任务成功率。
医疗AI迎来大考!南洋理工发布首个LLM电子病历处理评测 | AAAI'26
南洋理工大学研究人员构建EHRStruct基准,涵盖11项核心任务、2200个样本,用于评测LLM处理结构化电子病历的能力。研究发现通用大模型优于医学专用模型,提出的EHRMaster框架与Gemini联合后性能超现有模型。
成本仅0.3美元,耗时26分钟!CudaForge:颠覆性低成本CUDA优化框架
CUDA代码性能对模型训练与推理重要,但手动优化门槛高。明尼苏达大学团队提出CudaForge,是低成本多智能体CUDA Kernel生成与优化工作流,实验效果好,成本低且具通用性。
Anthropic承认模型降智后仍放任其偷懒?Claude Code用户信任崩塌中
此前大模型厂商未正面承认‘降智’,OpenAI 研究科学家称是心理错觉。但 Anthropic 公开承认旗下 Claude Opus 4.1 和 Opus 4 质量降级,然而问题未解决,Claude Code 用户信任崩塌,纷纷转向 GPT - 5。
支持5000+ Server,ScaleMCP为大模型Agents动态同步MCP工具
现有工具选择框架未整合MCP服务器,存在重复、不一致和低效问题。普华永道提出ScaleMCP,配备MCP工具检索器,还提出TDWA嵌入策略,通过实验证明其提升了LLM代理性能。
OpenAI发布GPT‑6 Astra:百万级上下文,主攻编程和复杂办公
9月3日,OpenAI发布GPT - 6 Astra,重点提升电脑操作、软件开发和复杂工作处理能力。它有诸多更新,如电脑操作提速、支持异步工具调用等,但也存在监测难、价格高的问题,实际效果待验证。
特斯拉Cybercab正式上线:没有方向盘没有刹车,已开始在奥斯汀拉客
当地时间9月3日,特斯拉在奥斯汀启动Cybercab付费服务,该车无方向盘、刹车等。其成本约1.8万美元,远低于对手。不过,它面临监管和技术约束,目前投放规模小,未来发展待验证。
DMLR 2026 | RPI Shaowu Pan(潘韶武)团队 Nithin Somasekharan等:CFDLLMBench——首个面向计算流体力学的大语言模型综合基准评测
文章介绍针对CFD领域的综合LLM评测基准CFDLLMBench,构建三层递进挑战体系。实验揭示主流LLM在‘知道’与‘做到’间有差距,多智能体框架可提升成功率,代码与数据集已开源。
一年一度最值得关注的AI榜单来啦!申报即日启动
时值第四届中国AIGC产业峰会,量子位将评选2026年度值得关注的AIGC企业与产品。介绍了参选条件、评选维度,报名4月27日截止,结果5月峰会公布,还介绍了峰会相关信息。