「参数效率」共找到 1815 篇相关文章
开源黑科技!向量数据库,居然要被 MP4 给干掉了!
GitHub开源项目Memvid,能用MP4视频文件替代昂贵的向量数据库,检索达亚秒级。它把文本编码成视频,用配套JSON索引记录位置,结合sentence-transformers和FAISS实现语义搜索,存储和检索性能出色。
刚刚,DeepMind通用科学智能体AlphaEvolve突破数学极限,陶哲轩合作参与
DeepMind发布革命性进化编码智能体AlphaEvolve,由LLMs驱动,可演化代码库、发现和优化算法。它结合LLM创造力与自动化评估,减少幻觉,在多领域应用前景大,还与陶哲轩合作探索数学应用。
Nanbeige4.2-3B:探索通用Agent小模型
在模型越做越大的当下,推理成本成了影响Agent大规模使用的关键因素。南北阁实验室推出Nanbeige4.2 - 3B,在架构、数据构造和训练pipeline层面做了系统工作,评测表现良好,还探索本地个人助手等应用。
腾讯混元AI Infra如何优化Hy3 Preview:一次大模型推理性能提升的技术拆解
文章聚焦腾讯混元AI Infra对Hy3 preview模型的推理性能优化。从算子优化与融合、并行策略等五大维度,剖析技术思路、算法及收益,如Attention算子单batch长文本最高加速2.95x,还提及后续显存优化等工作。
大模型已经够聪明了,为什么 95% 的 AI 项目还是跑不出 ROI?
2026年AI落地现悖论,模型能力强但多数项目难有ROI,原因是数据未准备好。腾讯云在AI产业应用大会宣布升级全栈数据平台,推出DataBuddy,可在多场景实现对话即交付,解决数据问题助力AI落地。
2篇最新Anthropic论文,揭开LLM对齐新范式
Anthropic在5月连发两篇研究,揭示LLM对齐训练新范式。指出单纯模仿正确行为不足以保证安全,需在预训练与对齐微调间插入教原理阶段。研究围绕Claude模型展开,有多项关键发现,MSM方法效果显著。
华创七星微:为直流供电系统筑起一道防火墙
随着AI等领域设备迭代,电源保护重要性凸显。华创七星微依托六类量产芯片和将问世的集成模块,为直流供电系统提供防护,其产品覆盖供电链路关键节点,有完整解决方案,还具备多种能力优势。
Qoder CLI + Harness Engineering 实战:构建 7×24h 无人值守用户反馈自动处理系统
在 Qoder 产品用户反馈增多、人力处理流程痛点凸显的背景下,构建 7×24 小时无人值守的用户反馈自动处理系统。该系统分四个核心模块,基于 Qoder CLI 实现,显著提升处理效率。
AI提效20%,我们程序员加班却越来越狠:老板量生产力的尺子,歪了?
文章指出 AI 虽提升编码效率,但整体提效有限,企业衡量开发者生产力的指标易走偏。不同行业对 AI 应用态度不同,企业需合理管理 AI 成本,未来人的价值体现在复杂工作中。
实测参考生之王Vidu Q3:这已经不叫AI生成了,这叫AI驱动整个剧组
4月13日生数科技发布视频大模型Vidu Q3,在SuperClue榜单断层登顶。它从‘生成视频’转向‘驱动剧组’,升级后能嵌入内容生产流程,实现‘万物可参,声画同出’,在多赛道表现亮眼。