「长链路智能」共找到 4105 篇相关文章
智谱新模型也用DeepSeek的MLA,苹果M5就能跑
智谱AI上市后发布新成果,开源轻量级大语言模型GLM-4.7-Flash,API免费开放调用。该模型是30B总参数、3B激活参数的MoE架构,定位为“本地编程与智能体助手”,评测表现佳,采用MLA架构,多平台支持。
一夜之间,核心决策权旁落:年入195亿的公司,未来走向何方?
近日,荷兰政府接管安世半导体,称其有治理缺陷。三名外籍高管联手让闻泰科技董事长张学政被暂停安世半导体职务。闻泰科技回应是过度干预,已启动法律与外交途径,安世在多领域有布局。
读万卷书,大模型就能「看」懂视觉世界?Meta揭秘LLM视觉先验的起源
Meta超级智能实验室与牛津团队新论文发现,只见过文本的大语言模型(LLM)能学到可迁移到视觉任务的先验能力。研究通过超100组受控实验、耗费50万GPU小时,揭开LLM视觉先验来源,还给出预训练数据配方。
高阶程序,让AI从技术可行到商业可信的最后一公里
文章指出进入AI下半场,可靠性成关键。当前多种探索路径有局限,企业常用RAG、智能体框架等方案也各有问题。而高阶程序(HOP)是神经 - 符号思想的工程实践,能为AI构建可靠控制系统,已在金融等行业展现价值。
文心新出的推理大模型,给了我们信心
在 WAVE SUMMIT 2025 大会上,百度发布文心大模型 X1.1,是 X1 升级版,发布即上线可免费体验。它在事实性、指令遵循、智能体等能力显著提升,全方位测评表现出色,还开源新模型,展现百度全栈 AI 实力。
AI正在淘汰“中间层”!昆仑万维方汉:要么冲进前10%,要么学会“向下兼容”
InfoQ 专访昆仑万维董事长兼 CEO 方汉。他指出 AI 会全面提升行业效率,促使从业者“向上”或“向下”发展;企业出海要选好市场、做好本地化和差异化;还探讨了 AI 商业化、开源等问题,认为开源能满足长尾需求、带来销售线索。
百度网盘的阵势真不小
作者参加百度AI开放日,看到百度文库和网盘发布一系列AI新功能,已发展成一站式AI内容生产力平台。如全新AI相机功能多,GenFlow 2.0体验流畅,背后依托沧舟OS打通全链路。这反映泛内容创作降门槛趋势。
DeepSeek 为什么把缓存涨了 11 倍?长上下文需求暴涨,得交点「存储税」了
8月17日,DeepSeek V4 Pro API输入和输出价格上涨,空闲时段缓存命中价涨5倍,高峰时涨11倍。此前其因高缓存命中率成性价比之选,但长上下文需求爆发致后端“缓存颠簸”,只能通过涨价收“存储税”。开发者可提高缓存命中率应对。
一个人+Claude+云服务,相当于一整个工程团队
网上两个实操演示被疯转,一是Google Cloud工程师用Claude配合Google云部署应用;二是Anthropic Claude团队教搭建带持久记忆的AI智能体。博主整理7天实操计划,将Claude变“全自动AI雇员”,还介绍多种AI雇员类型及成本。
独家|拿下5亿元海外订单,无界动力完成天使++轮融资,天使轮累计融资超2亿美元
AI科技评论独家获悉,通用具身智能机器人公司无界动力完成天使++轮融资,累计超2亿美元,天使+++轮也接近完成。其以隐空间世界模型构建具身大脑,区别于主流架构。还获远景超5亿订单,商业化落地成果多。