「大数据任务」共找到 7808 篇相关文章
缓存不该困在一台服务器里
本文分析大模型推理阶段KV缓存的行业痛点,指出传统单机缓存孤立无法跨节点复用的问题,介绍焱融科技的分层共享缓存方案,公开了方案的实测性能数据,展现AI存储的新发展方向。
Coatue 最新报告:复盘 400 年、 30+ 次泡沫,我们离 AI 泡沫还很远
Coatue 最新报告否定‘AI 泡沫论’,结合市场与消费数据,表明 AI 拉动经济。复盘历史,推出‘泡沫评分标准’。反驳市场对 AI 的 8 大质疑,还指出谷歌转型成功,预计未来 AI 利润可观,给出投资原则与指标。
刚刚,LeCun团队开源首款代码世界模型!能像程序员一样思考的LLM来了
Meta官宣发布代码世界模型CWM,将世界模型引入代码生成任务。它基于编程和世界建模数据训练,能模拟程序执行与交互。在编程基准测试中表现不错,算是Meta的概念验证,目前可看作Demo。
ACL 2025 高分接收 | 高感情语音技术:逻辑智能小语种TTS破局之道
语音合成技术在大语种发展好,但小语种因语料稀缺等面临挑战。逻辑智能团队提出针对低资源语言TTS的解决方案,构建泰语数据集,经先进预处理,其TTS模型效果好,有零样本克隆能力。
GPT之父把AI扔回1930年:没见过一行代码,却「发明」了Python!
GPT之父Alec Radford带队发布总参数130亿的大模型「talkie」,其训练数据冻结在1930年,没学过编程却能写Python代码,证明LLM可用旧知识推理。团队后续还有升级计划。
超越谷歌Banana,字节联合香港中文大学等高校开源最强图像编辑生成系统DreamOmni2
香港多高校与字节跳动联合研发的DreamOmni2系统,实现图像编辑与生成领域SOTA。它用三步造出高质量数据,提出索引编码等方案,联合训练模型,实际效果超越部分商业模型,为AI创作带来新可能。
18岁华人开源成果,火爆具身智能赛道
18岁华人小哥Eddy Xu的初创公司Build AI开源了有史以来最大的人类为中心数据集Egocentric - 10K,含10亿帧画面,规模是同类的100倍,场景扩展至工厂。不过其缺乏多模态信息,且human - centric路线也有局限。
Kimi K2技术报告正式发布:“保姆级”深度解析,一文读懂万亿参数智能体的所有秘密
Kimi K2技术报告发布,Moonshot团队用万亿+参数稀疏MoE架构等打造接近Claude - Opus的通用大模型。围绕训练稳定性等改进,有预训练、架构设计等多方面创新,为智能体领域提供可行路径。
AI招聘逆天研究:看照片预测一生职业成就
硅谷大厂HR标配的AI招聘系统Eightfold AI被指控算法歧视,求职者要求提高招聘筛选透明度。同时,美国多所高校研究者完成一项研究,AI能通过人脸照片预测职业走向,但因训练数据问题引发公平性争议。
10B超越Gemini-2.5-Pro!阶跃星辰端侧多模态天花板开源
阶跃星辰多模态智能团队开源STEP3-VL-10B多模态模型,仅100亿参数却性能惊人。它采用了独特的架构、训练策略与推理机制,在多任务上表现出色,为小模型发展提供新思路。