「Agentic领域」共找到 4215 篇相关文章
LLM-in-Sandbox:给大模型一台电脑,激发通用智能体能力
来自中国人民大学、微软研究院和清华的研究者提出LLM - in - Sandbox范式,让大模型在代码沙盒完成任务,实验显示其能提升多领域表现,无需额外训练,还能减少token消耗,研究者认为应取代纯LLM推理。
刚刚,国产GPU赛道又跑出一个 2700 亿估值独角兽!“中国AMD”沐曦股份完成 IPO,开盘大涨超 500%
2025年12月沐曦登陆科创板,股价达679元/股,估值破2700亿。其定位全栈GPU提供商,产品覆盖多领域。2022 - 2024年营收三年复合增长率超4000%,但累计净亏损超30亿。核心团队多来自AMD。
刚拿诺奖就登Nature封面!谷歌“量子回声”算法计算提速13000倍,可重复验证结果
刚获诺奖的谷歌量子团队登Nature封面,提出“量子回声”算法,计算提速13000倍且结果可重复验证。解决了量子计算结果难确认问题,该算法在多领域有应用潜力,还依赖Willow芯片优势。
Kimi K2发布两天即“封神”?80%成本优势追平Claude 4、打趴“全球最强AI”,架构与DeepSeek相似!
国内独角兽月之暗面发布开源模型 Kimi K2,推出两天就在 OpenRouter 超越 xAI 的 Grok 4。它成本优势大,能力泛化和实用性强,编码、Agent 工具调用等方面表现出色,架构与 DeepSeek 相似。
2025上半年大模型使用量观察:Gemini系列占一半市场份额,DeepSeek V3用户留存极高
推特博主「karminski - 牙医」基于OpenRouter数据,分析2025年上半年大模型API市场,涵盖总Token使用量、市场份额、细分领域用量、API接口使用趋势等,得出各模型表现及市场格局的观察结论。
对话涌生智能杨梦:AI for Bio的下一场竞争,是把实验闭环验证真正做出来
随着科技巨头进入生命科学领域,AI for Bio竞争升级,焦点转向模型能否进入科研流程。涌生智能与上海人工智能实验室发布成果,为跨越鸿沟提供新路径。对话涌生智能杨梦,探讨相关技术路径、产业思考等。
从Vibe Coding到Harness—— 一套大仓AI工程化实战
这是腾讯后端微服务与前端微应用大仓的 Harness 实战分享。介绍了 TAB 工程背景、Harness 组成部分,阐述阶段划分、Agent 演进等,还提及人工关卡、门禁脚本等要点,总结了经验与限制。
真钱买假模型?187篇论文被「套壳API」坑惨,准确率暴跌
CISPA论文指出,第三方影子API可能用廉价替代品替换前沿大模型。研究追踪17个服务,发现已被187篇论文引用。测试显示,影子API在多领域性能差,安全不可控,供应商有三种欺骗手段。
谷歌AlphaEvolve太香了,陶哲轩甚至发了篇论文,启发数学新构造
著名数学家陶哲轩与 Google DeepMind 研究人员发表论文,展示谷歌 AlphaEvolve 作为工具可自主发现新数学构造,该系统结合 LLM 与进化计算,在多领域问题上表现出色,还能与其他 AI 工具结合。
告别微调!腾讯提出Training-Free GRPO:无需更新参数,还能保证泛化性,成为传统RL的有力替代
大型语言模型在专业领域表现不佳,传统微调方法成本高、易过拟合。腾讯优图实验室提出Training - Free GRPO,无需更新参数,通过上下文学习提升性能,成本低且泛化性好,是传统强化学习有力替代。