「推理技术栈」共找到 4701 篇相关文章
基于闪电注意力机制,创新高效开源大模型
传统Transformer架构处理长文本和复杂推理任务有效率瓶颈,多数领先模型仍依赖传统注意力设计。MiniMax开源基于闪电注意力机制的专家混合模型Minimax,从架构、创新模块、训练框架等多方面优化,表现突出。
告别Transformer!北大、北邮、华为开源纯卷积DiC:3x3卷积实现SOTA性能,比DiT快5倍!
北大、北邮和华为研究提出纯卷积扩散模型 DiC,抛弃自注意力机制回归 3x3 卷积。它性能超 DiT,推理速度快 5 倍,证明精心设计的卷积网络在生成任务中也能表现卓越。
90后清华博士厨房机器人融资数千万,拿下北京市首张具身智能机器人食品经营许可证
享刻智能官宣完成数千万元Pre - A轮融资,创始人陈震是连续创业者。其LAVA厨房机器人获北京市首张具身智能机器人食品经营许可证,已签千台级订单,还将围绕‘三机一体’架构升级技术。
Gemini新版蝉联竞技场榜一,但刚发布就被越狱了
谷歌深夜官宣Gemini 2.5 Pro推出新版本(0605),在代码、推理等任务表现提升,超o3,Elo评分也提高。但发布两小时就被越狱,还被指部分指标较早期版本退步。
什么!我把SQL编辑器装进了大模型?
文章介绍基于约束解码技术,结合CFG、Jinja模板和XGrammar框架,为大模型SQL生成配备“编辑器”。它能保证语法正确、遵循规则,还具灵活性。但面临约束干扰和性能瓶颈,未来可简化配置惠及更多用户。
LLM又曝致命缺陷:根本不会看时钟!博士惊呆,准确率不及50%
最新研究揭示AI存在认知缺陷,读取时钟准确率仅38.7%,判断日历日期准确率26.3%。研究者构建测试集考察MLLM能力,虽部分模型有亮点,但整体表现不佳,凸显训练数据和推理方式改进需求。
Claude Opus 4.7,全网差评!刚升级就翻车,用户怒斥:还我4.6
Claude Opus 4.7刚发布就遭全网吐槽,价格贵50%,性能却严重倒退,出现幻觉、计算拉胯等问题。用户质疑Anthropic为省钱缩水模型,罪魁祸首可能是新引入的“自适应推理”功能。
逼AI当山顶洞人!Claude防话痨插件爆火,网友:受够了AI废话
一个叫「caveman」的Claude Code插件在Hacker News爆火,冲破2w星。它核心是条prompt,删掉冠词等废话,号称省75%输出token。但它不压缩模型后台推理token,真实成本节省存疑。
先进封装成为AI芯片胜负手
2026年先进封装企业在多方面有新进展,其对芯片性能等指标影响大,全产业链都在加码布局。委外封测厂、代工厂看好其营收贡献,市场动能明确,各环节技术创新也多点突破。
一次代码提交=250万美元!xAI被开除工程师大爆料,揭秘马斯克“人类模拟器”秘密项目
xAI技术成员Sulaiman Ghori在播客披露公司内幕被开除。他透露了“人类模拟器”项目、算力工厂建造细节、内部工作文化等敏感信息,还描绘了充满马斯克风格的xAI工作画像。