「长任务时代」共找到 3501 篇相关文章
上交大和辉羲把LLM刻进ROM!推理性能冲2万token/s,GPU时代终结?
硅谷Taalas将大模型‘物理焊死’进芯片引关注,而上海交大、辉羲智能与微软亚洲研究院团队用ROM+SRAM异构架构,将端侧LLM推理速度推至20,000 tokens/s。介绍了ROMA和TOM架构优势及应用场景。
天使轮数千万元融资,这家公司想成为 AI 时代用户的安全执行顾问
主打认知安全的缔零科技获数千万元天使轮融资,资金用于「缔零法则」技术迭代等。其产品以AI治理AI,降本增效。公司曾推「缔零智数」,现「缔零法则」把控模型推理。未来有ToC计划,想成用户安全助手。
OpenAI 推出 gpt-realtime:语音智能体进入“秒回”时代,开发者直呼交互更自然
OpenAI 发布语音对语音模型 gpt - realtime,开放 Realtime API。其结合可端到端处理语音,缩短响应时间。模型语音质量、理解能力、函数调用能力提升,API 全面升级,多家企业已试点,还强化了安全措施。
00后8亿美金「掀桌」!硅谷AI将书写影视新传奇,终结制片旧时代
00后华人女CEO Cecilia Shen带队转型Cybever为全球首家AI原生影视工作室Utopai Studios,首年获1.1亿美元收入。其技术从3D虚拟环境生成发展到完整视频制作,还推出两部大作,或改变影视行业格局。
阿里云 CIO 蒋林泉:AI 大模型时代,我们如何用 RIDE 实现 RaaS 的首次落地?
阿里云 CIO 蒋林泉分享大模型落地实践,指出 AI 是时代“大电梯”,企业需迅速搭乘。介绍阿里云数字人多场景应用成果,提出 RIDE 方法论助企业落地,还剖析翻译与 Agent 模式要点及 E2E 落地关键。
字节开源终身记忆多模态智能体,长时记忆+RL,实测超Gemini‑GPT4o!
字节开源全球首个带终身记忆更新的全多模态智能体M3 - Agent,给其装上‘长期记忆’大脑。它构建实体记忆图谱解决现有Agent问题,架构含两个流程,代码实现有特色,跑分数据出色。
1万tokens是检验长文本的新基准,超过后18款大模型集体失智
Chroma团队研究发现,将上下文扩展至1万tokens,18款主流大模型集体“失智”,“智商”非均匀下降,在一些节点会断崖式下跌。研究还设计四项对照实验,证明LLMs性能随输入长度增加显著且非均匀下降。
奖励模型终于迎来预训练新时代!上海AI Lab、复旦POLAR,开启Scaling新范式
在大语言模型后训练阶段,奖励模型设计与训练是关键瓶颈。上海AI Lab、复旦推出预训练奖励模型POLAR,采用策略判别学习新范式,适配强化微调,性能和泛化能力强,为LLM后训练带来新可能。
录音笔的终结者,还是AI时代的又一个“美丽废物”?深度体验出门问问TicNote
作者体验出门问问AI硬件产品TicNote一个月,称其超薄超轻,有双模式录音功能,解决手机录音痛点。软件强大,支持多语种和方言,能自动总结,还可拓展内容。价格有两档,适合多类人群。
单GPU搞定高清长视频生成,效率×10!引入Mamba机制突破DiT瓶颈 | 普林斯顿&Meta
普林斯顿大学和Meta联合推出新框架LinGen,以MATE线性复杂度块取代传统自注意力,使单张GPU能在分钟级生成高质量视频。它在视频质量上优于DiT,减少FLOPs和延迟,与先进模型相当。