「空间能力评估」共找到 4122 篇相关文章
对话 IDEA 张磊:「不以动作为输入条件,就不叫世界模型」
本文是对IDEA研究院张磊的深度访谈。张磊在计算机视觉领域成就斐然,他指出具身智能落地需攻克成功率、泛化性等挑战,大脑比本体更关键。还阐述了世界模型概念及应用,定义其应具备动作依赖等内容。
AI给你的总是平庸答案?5.8万星插件证明:问题不在模型,在你
GitHub上5.8万星的`taste-skill`仓库,无模型代码,仅用文本规则让AI编程工具输出更有品味。揭示AI默认给平庸答案是概率采样结果,还给出反中位数三问及AI时代变贵的是判断力。
“今天的顶级智能,一年后就会沦为平庸的廉价品” OpenAI总裁:AGI 的终极交互是“没有界面,没有产品”
OpenAI总裁Greg Brockman分享了对AI发展的看法,称2023年推出的插件功能失败,因当时大模型未准备好。他认为未来AGI是隐形虚拟助理,无界面和产品。还指出算力稀缺,智能折旧快,模型改进空间大。
大模型推理也能“智能调度”:让奖励模型按需分配算力的动态路由机制 | ACL 2026
生成式奖励模型(GRM)推理策略存在算力浪费问题。腾讯混元与新南威尔士大学联合提出 E - GRM 框架,将模型不确定性定义为调度信号,按需推理。文章从多维度解读该框架,并展示实验评估结果。
Sonnet 5 翻车!同性能价差最高 56倍,海外巨头为何复刻不出 DeepSeek?
Anthropic发布Claude Sonnet 5,官方称补足了Agent能力,价格优惠,但开发者反应不佳。Sonnet 5因tokenizer换代,实际使用成本更高,且比同类模型贵。与之相比,DeepSeek V4 Pro便宜很多,其靠技术实现低价,海外厂商难以复刻。
世界模型公司「厘清智能」完成数亿元种子轮融资,顺为红杉高瓴齐押注
清华系初创公司「厘清智能」完成数亿元种子轮融资,投资方豪华。其构建世界模型系统,全栈自研,释放强大泛化能力。由97年博导李一鸣领衔,集结名校人才。资本认为其是稀缺的‘范式级’团队。
米哈游一夜烧掉200万元Token,大厂高管也开始质疑:Token烧不出价值,但养肥了谁?
Uber运营负责人质疑AI tokenmaxxing成本合理性,米哈游员工一晚烧200万Token。部分公司开始调整,如多邻国取消AI使用绩效评估,Shopify阻止失控消耗。Tokenmaxxing让模型厂商、编程工具和算力相关方受益,盲目跟风企业或成输家。
后OpenClaw时代!国产Agent模型凭「高配低价」叫板Opus 4.6
昆仑万维旗下天工AI发布SkyClaw - v1.0智能体模型及轻量化版SkyClaw - v1.0 - lite。该模型在底层能力提升,适配主流框架,跑分和实际应用表现出色,还具有低门槛、高性价比优势,限时免费体验。
Qwen3.7:智能体新前沿
阿里云正式发布面向智能体时代的Qwen3.7-Max模型,将通过API提供服务。它能力全面,编程、办公、长周期执行等表现出色,适配多框架,在多场景评测中领先,能驱动生产力跃升,还经多实战测试验证实力。
英伟达MIT出手!华人团队重磅开源,大模型推理内存暴降10倍
英伟达、MIT、浙大华人研究者联合推出TriAttention,核心是在pre - RoPE空间用Q/K三角集中度估计KV token重要性,保留关键部分。它使内存消耗降10倍,吞吐量提2.5倍,还提供vLLM集成和MLX实验性支持。