「任务系统升级」共找到 4148 篇相关文章
AI最尴尬的短板,中国科学院出手了
7月24日,中科院计算所“知境”团队发布知境社会心智大模型技术体系,为现有大模型补社会心智短板。其建评测体系SoMBench,设计训练系统Zing,用部署架构Actio,在多评测超越GPT - 5.5等,应用前景广。
调高一档推理强度,成本可能翻几倍:大模型思考原理讲清楚
文章详细讲解推理强度原理,指出其不改模型,只改草稿长度。还说明模型多思考能提高答题准确率的原因,剖析贵和慢的原因,介绍三种控制形态,并给出判断推理强度档位的框架。
verify-data:一个端到端的数据验数 Agent Skill
本文介绍端到端数据验证 Agent Skill——verify-data,它能自动完成从表结构获取到报告发布全流程,将传统手工验数升级。文章从多方面展开介绍,还给出未来演进方向,为开发者提供参考。
画数独、烧蜡烛都不翻车了?浙大&阿里让AI先三思再下笔|ACL 2026
当下视觉生成中,开源模型在逻辑推理生成任务上频频翻车,与闭源模型有差距。浙大与阿里团队提出Unified Thinker,将思考与执行解耦,构建数据集、采用创新算法,实验显示其有效提升逻辑执行准确度。
牛芯国产先进工艺 DDR5/LPDDR5 IP双双突破6400Mbps
随着人工智能等领域发展,系统对数据吞吐能力需求攀升。牛芯半导体基于国产先进工艺研发DDR5/LPDDR5 IP,实现6400Mbps高性能验证,通过创新弥补工艺代差,打通国产链路,具成本和安全优势。
苹果画的饼谷歌率先搞定!Gemini全面进驻全家桶,连鼠标都AI上了
在Android Show独立发布会上,谷歌推出诸多新品,核心是将Gemini嵌入安卓底层,还带来AI鼠标光标、Googlebook等。Gemini能跨应用执行任务,Googlebook为其量身打造,谷歌这波操作像把苹果画的饼烙好端上桌。
智谱公布“降智”的秘密:Scaling不可避免的痛
智谱最新技术博客大倒苦水,称从GLM - 5以来遭遇「Scaling Pain」。团队排查出高负载下推理状态管理等问题致异常,还给出避坑指南,如在线异常监控策略,优化后系统更稳定,吞吐量提升。
对话清华商宇丨从生成视频到支撑行动,世界模型需要新的评测标准
文章围绕清华团队提出的 WorldArena 评测框架展开。它针对具身世界模型,对过去沿用视频生成的评测逻辑重新审视,从视觉质量和功能性任务两维度评估,推动世界模型从‘生成世界’迈向‘使用世界’。
从Cursor返聘归来,90后华裔女高管带Claude开启日更模式:token成本比工程师工资低多了!
90后华裔女高管Cat Wu推动Anthropic产品“按天迭代”,她认为token成本低于工程师工资。她分享了产品发布、团队协作等经验,还谈到AI时代PM应具备的能力,以及Claude系列产品的使用和发展方向。
2026 年做搜索就是做 Agent Memory
本文整理自Elastic全球副总裁肖涵演讲,讲述AI搜索发展历程,指出2026年做搜索基本是做智能体记忆。分析智能体记忆痛点、表征、遗忘等问题,介绍Jina AI相关模型,梳理记忆产品分类与工作流,给出行业观点与建议。