词元跳动」共找到 1137 篇相关文章

推荐文章7

RAG 进化之路(祛魅 Agentic RAG):传统 RAG 到工具与强化学习双轮驱动的 Agentic RAG

文章旨在祛魅 Agentic RAG,先介绍传统 RAG 的离线入库和在线应用,指出其不足。再阐述 Agentic RAG 让 LLM 自主决策,结合工具执行循环。还介绍基于提示和强化学习的实现方式,最后总结不同 RAG 的优劣。

chaofa用代码打点酱油
开源动态8

从AI Agent到Agentic AI:开源如何助力开发者解决行业痛点?

2025年全球开源软件项目数量增长,中国企业贡献显著。字节跳动在火山引擎原动力大会开源开发者日上,多位负责人分享开源经验,探讨其为AI Agent带来的技术改变,展示解决行业痛点的理念与实战经验。

InfoQ
算法论文8

谷歌助力神经科学飞跃,破解斑马鱼全脑活动密码

谷歌等机构科学家联合发布开创性研究成果ZAPBench,这是预测斑马鱼全脑活动的基准测试平台。它含超70000个神经4D光片显微镜记录,设计多种刺激条件采集数据,有特定基准测试任务和评估指标。

AIGC开放社区
产品应用8

MoE不够看了,腾讯推出MoT:2B具身模型22项评测16项最佳

腾讯混团队联合Robotics X实验室推出HY - Embodied - 0.5系列基础模型,含MoT - 2B和MoE - 32B两款主力模型。在22项评测中,MoT - 2B获16项最佳,其架构、数据和训练有创新,能应用于机器人控制。

量子位
新闻资讯8

5款大模型考「山东卷」,Gemini、豆包分别获文理第一名

近日,字节跳动Seed团队用2025年山东高考真题对5款大模型进行全科闭卷测评。结果显示,豆包Seed1.6 - Thinking获文科第一,Gemini 2.5 Pro获理科第一。大模型一年间进步显著,未来或融入更多领域。

机器之心
推荐文章8

Andrej Karpathy 爆火演讲刷屏技术圈:AI 开启软件 3.0,重写一切的时代来了!

Andrej Karpathy 在旧金山 AI 创业学校演讲,指出 AI 开启软件 3.0 时代,自然语言成编程接口。软件经历 1.0 代码、2.0 神经网络权重,现进入 3.0 用提示编程大模型阶段,还探讨大模型特性、应用及相关问题。

InfoQ
推荐文章8

多智能体在「燃烧」Token!Anthropic公开发现的一切

Anthropic发布多智能体研究系统构建解释,解决多智能体研究困惑。多智能体系统优势明显,在特定任务中表现出色,但token消耗大。其架构独特,还介绍了提示工程、评估方法、面临的工程挑战等内容。

机器之心
产品应用8

实测腾讯首个 AI IDE 产品,小白也能『批量开发』微信小程序

2025年AI Coding领域竞争激烈,腾讯7月22日揭幕国内首款“产—设—研”全链路AI IDE CodeBuddy。它支持主流模型,能将想法转化提示等,通过多个案例展示其强大功能,腾讯还计划让其普惠开发者。

鲸选AI
推荐文章8

同一个模型,换套框架成绩差27%:SWE-bench分数到底谁说了算?

编程Agent评测是笔糊涂账,SWE - bench虽成事实标准,但分数不适合直接横向比较。基律动等机构发布Claw - SWE - Bench基准,将模型、harness和任务集拆分,通过实验揭示harness对成绩影响大,还解决通用Agent评测问题,推出低成本Lite版。

AIGC开放社区
新闻资讯7

GPT-5.2被曝作弊!偷袭谷歌竟靠拉爆token刷高分,不如Gemini 3

新智报道,OpenAI刚发布GPT - 5.2就被指「作弊」,其在基准测试中或调参数使模型用更多算力资源。有用户发现它消耗远超对手的token才获成绩,真实能力或与Gemini 3相当。此外,还揭示了OpenAI为商业利益牺牲学术独立的问题。

新智元