「技术收敛范式」共找到 3654 篇相关文章
夸克做ChatBot,为什么是现在?
AI行业曾有“垂直Agent幻觉”误区,重演App时代“功能碎片化”老路。而模型趋势是泛化与整合。10月23日夸克上线“对话助手”,其此时入局是基于技术、竞争和交互形态三重判断,且有模型和系统双重保障。
EMNLP 2025 | CARE:无需外部工具,让大模型原生检索增强推理实现上下文高保真
MetaGPT等机构团队发布CARE框架,可让LLM将推理上下文与自身检索能力结合,已全面开源。它提出原生检索增强推理范式,采用两阶段训练策略,在问答基准实验中表现出色,为解决模型问题提供新路径。
默认选择 React,等于是在扼杀前端创新
文章指出默认选 React 正减缓前端创新。如今团队选前端常出于习惯而非技术契合度,使 Svelte、Solid、Qwik 等创新框架难被采用。默认选 React 还带来运行成本、架构惰性等问题,呼吁根据需求选框架。
大模型之后,AI 开始“自己动手”了
从生成式AI到Agentic AI,互联网从“信息获取”转向“任务完成”。全球科技巨头抢滩智能体,国内腾讯云升级智能体开发平台。腾讯吴运声表示,技术与业务需求双轮驱动其发展,还分享了应对落地挑战的办法。
3B激活参数!商汤绝影Sage登顶PinchBench,端侧第一
商汤绝影Sage端侧大模型在PinchBench评测中,以94%任务完成率超越Claude、GPT - 5.4等主流大模型。它激活参数仅3B,算力需求低,还具备多项实用场景能力,靠SCOUT和ERL两项自研技术提升性能。
高通组局,宇树王兴兴说了一堆大实话
在2025骁龙峰会·中国上,宇树王兴兴等大咖畅所欲言。王兴兴指出机器人领域技术路线不同进展慢,建议模型开源,还强调芯片对机器人的重要性;李大海认为端侧模型是Agent核心;勾晓菲谈汽车服务竞争;耿增强呼吁Agent形成行业标准。
Google 发布 142 页年度DORA 报告:90% 开发者每天花 2 小时使用AI,比去年增长14%
Google发布142页年度DORA报告,显示90%开发者每天花2小时用AI,比去年增14%。开发者对AI代码信任谨慎,看法分化,速度提升比质量改善明显。报告还分析团队类型、采用时间等,指出技术限制和就业现状。
Mini-Omni-Reasoner:实时推理,定义下一代端到端对话模型
现有端到端对话模型推理能力未解锁,因深度思考带来延迟。为此提出 Mini - Omni - Reasoner,采用边思考边表达范式,突破‘要么快,要么准’困境,还设计了数据合成管线和五阶段训练方法,实验证明其性能提升明显。
狂拿大模型明星订单,一家清华系HPC-AI Infra公司浮出水面
本文介绍清华系计算创业公司是石科技,其93年创始人闫博文不囤算力仍拿下大模型明星公司订单。团队技术实力强,3次获戈登·贝尔奖。公司构建全栈能力,为多领域提供服务,未来想以算力赋能各行业。
DeepSeek-V3再发论文,梁文锋署名,低成本训练大模型的秘密揭开了
DeepSeek 发布围绕 DeepSeek-V3 的技术论文,从硬件架构和模型设计双重视角,探讨实现经济高效的大规模训练和推理的方法。介绍了 DeepSeek-V3 的创新设计,如 DeepSeekMoE 架构、MLA 架构等,还给出未来硬件架构设计建议。