「智能体开发平台」共找到 5538 篇相关文章
大模型微调评测入门:看懂这些指标,才知道模型好不好
文章指出大模型微调中很多新手重“调”轻“评”,评测是决定模型落地的关键。介绍分类和生成任务评测指标,给出实操步骤,还说明如何综合判断模型好坏,最后展望评测技术朝自动化等方向发展。
又是中国团队!一条链接出片,电商AI视频迎来「DeepSeek时刻」
电商AI视频此前生成效果不佳,难以用于投放。营赛AI发布的inSai Hilight是“下一代营销视频解决方案”,在权威评测中表现出色,能保证商品和数字人一致性,靠知识图谱等技术实现高质量视频生成。
LLM时代的事件抽取:从静态任务到认知脚手架
此综述论文探讨LLM时代事件抽取价值,认为其未被削弱,应视为“认知脚手架”。它系统梳理任务分类、方法演进等,还提出六大未来研究方向,指向将其演化为智能感知与记忆层。
100万辆“斩杀线”出现,2026年中国智驾进入淘汰赛|甲子光年
2025年中国智能驾驶行业进入规模与交付主导阶段,100万辆成为2026年智驾行业‘斩杀线’。华为已跨过‘安全区’,地平线、卓驭等构成一线梯队。毫末智行等公司因技术与交付问题出局,行业竞争更残酷。
480万人围观的Claude code实战使用指南进阶来了:一文讲清Skill,子代理和MCP
Eyad发布Claude Code开发实战进阶篇,深入剖析其底层系统的Skills、Subagents和MCP connectors三大核心能力。通过对比,突出Claude Code在上下文窗口上的优势,还介绍了各功能用法及复合效应。
奥特曼点名「AGI最后一块拼图」!记忆,才是硅谷2026新共识
2026年,AI竞争焦点从Scaling转向记忆。奥特曼押注记忆,预计ChatGPT产品线未来一年有进展。AI记忆能力成新共识,提升其记忆成巨头竞争核心,不过距完善记忆系统还远。
8块钱跑通一次强化学习全流程,潞晨云重塑微调赛道:1名算法工程师=1支Infra团队
大模型下半场,后训练特别是强化学习成核心战场。潞晨云微调SDK上线,它是国内首个全面开放、且兼容Tinker范式的Serverless微调平台,为强化学习提供低成本解法,在易用性和成本上有优势。
离开OpenAI后,这位27岁的首席AI科学家要带腾讯走向AI的下半场|姚顺雨
今年9月姚顺雨从OpenAI离职传闻加入腾讯,如今腾讯内部公告尘埃落定。27岁的他出任腾讯相关要职,腾讯还升级架构。他学术成果丰硕,有产品能力,提出AI下半场观点,或为腾讯带来多方面提升。
罗福莉携小米MiMo-V2-Flash首次亮相:一次在推理与Agent上的下注|甲子光年
大模型进入新阶段,效率成能力一部分。小米MiMo团队12月16日晚发布并开源MiMo - V2 - Flash,负责人罗福莉首亮相。该模型在推理、编程和智能体场景表现出色,在架构、训练方法等有创新。
普林斯顿大学等Nature揭秘:人类大脑与大语言模型共享同一套语言处理时钟
普林斯顿大学等机构研究发现,大语言模型层级计算序列精确映射人类大脑处理语言的毫秒级时间动态,其与人类大脑理解语言的先后顺序高度一致,为理解大脑和开发神经网络架构开辟途径。