「芯片方案」共找到 1432 篇相关文章
ICML 2025 | 长视频理解新SOTA!蚂蚁&人大开源ViLAMP-7B,单卡可处理3小时视频
在视觉语言模型取得突破的当下,长视频理解挑战凸显。蚂蚁和人大团队提出视觉语言大模型ViLAMP,采用‘混合精度’策略,在多基准测试中超越现有方案,单卡可处理3小时视频,为实际应用带来新可能。
对话 XYZ-Aquila丨Deep Search SOTA 背后 AI 到底怎么参与改进 AI?
近日,XYZ AI Lab发布两款面向Deep Search的Agent,在评测中领先。其采用AI4AI方法,让AI参与研发判断。团队接受采访,探讨AI4AI含义、与RSI关系、工作范式等,还分享了改进案例和未来方向。
解码加速15倍!EdgeRazor助推大模型在PC/移动端“狂飙”
大语言模型参数膨胀,端侧部署难,量化成主流轻量化方案。开源工具库EdgeRazor由南京大学和微软联合推出,采用MPQAD打破极低比特大语言模型“能力塌陷”,在性能、效率、易用性等方面表现出色,打通AI全生态链路。
Hermes推出Curator功能:自动清理Skill 仓库
Hermes推出Curator功能解决技能仓库膨胀问题。它每7天(可配置)自动运行,检查技能使用频率等数据,将30天未用技能标记为‘stale’,90天未用的移至归档目录,还能建议技能合并方案。
盘点过去一个月,大厂悄咪咪上线的 CLI 和 Skill
过去一个月,淘宝、微信支付、支付宝等大厂纷纷将核心能力以 MCP、Skill、CLI 形式交给 AI Agent 调用。如淘宝支持 AI 完成购物操作,支付巨头开放 AI 接入方案,滴滴和千问有打车 Skill 等。
科研的回归:AutoSOTA如何终结“增量式优化”的重复劳动
当前AI科研中,为提升性能指标,研究者投入大量精力做“增量式优化”,限制原创探索。AutoSOTA项目由清华与中关村学院联合发布,它基于智能体系统构建自动化方案,接管实验迭代,一周发现105个SOTA模型,推动科研回归原创。
上交大和辉羲把LLM刻进ROM!推理性能冲2万token/s,GPU时代终结?
硅谷Taalas将大模型‘物理焊死’进芯片引关注,而上海交大、辉羲智能与微软亚洲研究院团队用ROM+SRAM异构架构,将端侧LLM推理速度推至20,000 tokens/s。介绍了ROMA和TOM架构优势及应用场景。
谷歌AI的“心脏”长什么样?读懂TPU就够了
文章介绍了谷歌TPU的发展历程,从2015年为解决AI计算效率瓶颈自研,发展到如今成为谷歌“经济支柱”。还对比了谷歌、英伟达、亚马逊的芯片路线,强调谷歌全栈垂直整合策略使TPU在推理时代优势明显。
OpenAI开启“印钞机”模式?ChatGPT官宣引入广告,新增8美金/月Go版低价订阅服务
OpenAI宣布广告业务要来了,其低成本订阅服务ChatGPT Go将登陆美国及所有ChatGPT可用地区。未来几周将在美国免费版和Go版中测试广告,Pro、Business和Enterprise订阅方案无广告。还明确广告业务五大原则。
当亚马逊云科技拿到“麦克”,一年的云计算叙事都被改写了
2025亚马逊云科技re:Invent大会上,CEO Matt Garman围绕Agentic AI落地发布系列新品。其认为落地需四大支柱,亚马逊云科技带来如芯片、模型等成果,还强调私有数据及开发者工具重要性,多个企业已实践应用。