数据使用」共找到 3657 篇相关文章

开源动态8

不改模型、不降质量,谷歌让Gemma 4快了3倍:本地跑大模型彻底变天

谷歌给Gemma 4家族更新Multi - Token Prediction推测解码架构,推理速度最高提升3倍且输出质量不变。介绍了LLM推理慢的原因、MTP解决办法、对开发者的利好、技术细节、使用方式等。

AI寒武纪
推荐文章7

智谱公布“降智”的秘密:Scaling不可避免的痛

智谱最新技术博客大倒苦水,称从GLM - 5以来遭遇「Scaling Pain」。团队排查出高负载下推理状态管理等问题致异常,还给出避坑指南,如在线异常监控策略,优化后系统更稳定,吞吐量提升。

量子位
算法论文8

生成式推荐补上关键一环!语义ID首次实现可微分联合优化 | SIGIR'26

生成式推荐依赖语义ID,可现有语义ID常先学好再冻结,与推荐目标不一致。论文DIGER首次将可微分语义索引机制引入生成式推荐框架,让推荐损失参与语义ID学习,还设计策略解决训练问题,实验表现佳。

新智元
开源动态7

Claude Code 项目初始化模板:黑客松冠军团队的生产级配置

claude-init 是 Claude Code 项目初始化模板,集成黑客松冠军团队生产级配置。有三层文档架构、9 个专用子智能体、10 条快捷指令、8 条强制规则及智能上下文管理,助开发者高效配置使用

小华同学ai
新闻资讯7

Claude 最歧视的,是印度阿三

AI研究员Aran Komatsuzaki实验发现,Claude的tokenizer对非英语用户不友好,印地语用户消耗token是英语的3.24倍,带来高成本、高延迟等问题。不同模型对不同语言token处理有差异,市场份额影响token效率。

AGI Hunt
产品应用8

π0.7的泛化能力有多强?零样本纯靠口述就能用空气炸锅,演示完换个机械臂也能叠衣服

2026年4月16日,美国明星机器人AI公司Physical Intelligence发布模型π0.7。它具组合泛化能力,借助多模态提示框架,能零样本完成新任务。在空气炸锅、叠衣服等实验中表现出色,有望推动具身智能发展。

DeepTech深科技
新闻资讯7

Claude Opus 4.7深夜上线,评分碾压

周四晚间,Anthropic 宣布 Claude Opus 4.7 全面上市。它在高级软件工程、视觉效果上表现出色,多项基准测试优于 Opus 4.6。还具备新特性,如自动模式等,安全性能与 Opus 4.6 相似。此外,Anthropic 还有相关更新。

机器之心
推荐文章7

前 YC 创始人:在家带四娃,还跑着 11 个 AI Agent

前 YC 创始人现为全职妈妈,带四个娃同时运行 11 个 AI Agent,将其融入家庭教育与生活。分享 Agent 搭建经验、遇的问题及教训,还预测 AI 会逆转生育率下降趋势。

特工宇宙
算法论文8

性能提升400%!AutoResearchClaw自主设计多模态记忆大脑

AI助手积累海量多模态数据,记忆和提取成瓶颈。北卡罗来纳大学等团队用AutoResearchClaw让AI 72小时完成多模态记忆系统设计,性能提升超400%,新系统OMNIMEM全面碾压现有主流系统。

AIGC开放社区
新闻资讯7

米哈游蔡浩宇AI公司首个视频模型曝光了

米哈游蔡浩宇的AI公司Anuttacon首个视频模型LPM 1.0曝光。它可通过多模态形式生成动态角色,有超绝情绪演绎、实时视频生成等能力,背后技术架构复杂,目前未正式上线。

量子位