「语言服务」共找到 1695 篇相关文章
AgentA/B:用AI模拟用户,真人AB测试或将成为历史
宾夕法尼亚州立大学和亚马逊合作研发AgentA/B测试框架,用大语言模型生成虚拟用户模拟真实行为,成本低、速度快,还能绕开真实流量测试。虽有人质疑,但它或改变传统AB测试。
5个月估值翻10倍,AI数据赛道跑出一家新独角兽
成立约18个月的AI训练数据公司AfterQuery正筹新一轮融资,估值达32亿美元,5个月涨超10倍。它最初想开发AI智能体,后转收集训练材料。此赛道已有多家高估值公司,且数据隐私和安全风险待解。
复旦硬核青年:破解核材料百年难题,为人造太阳锻造不灭铠甲
张宏亮童年时便渴望稳定电力,考入复旦后历经行业寒冬。他深耕核材料研究,取得多项成果,能用新技术降低成本、能耗,揭示材料新机制,回国后又搭建研究系统、优化工艺等,还看重产学研结合和跨界融合。
AI 真的太贵了
国内AI套餐价格高、额度低,用户体验不佳。多数国产模型开源,不存在资源问题,但厂商毛利率高达90%。高价阻碍应用层发展,AI应降低价格,让更多人用起来,提升社会生产力。
The Batch: 964 | Claude 亮相另一款 Opus
Anthropic发布Claude Opus 5,这是款视觉 - 语言模型,运行成本低,多任务表现优于Claude Fable 5。它在多项测试中领先,解决了Fable 5的一些问题,但也有易产生幻觉等不足。
从「找视频」到「产视频」:快手RaG推动推荐系统迈向完全生成时代
快手最新论文提出的 Recommendation-as-Generation(RaG),把推荐系统从「在已有视频里找答案」推进到「根据用户兴趣生成答案」,已在快手大规模广告系统中部署,带来广告收入提升。
ICML 2026 | Agentic强化学习训练的信息自锁问题
随着大语言模型走向真实交互,强化学习训练LLM agents时出现信息自锁问题。香港中文大学等研究者分析其原因并提出AREW方法,在多场景实验中表现稳定且具鲁棒性。
京东JoyInside戴文军:AI的终极形态不是聊天,是融入你家每一件物品丨AIGC2026
京东科技JoyInside业务负责人戴文军在AIGC2026峰会上提出,AI终极形态是融入万物,硬件将主动感知、理解需求。JoyInside以附身智能给硬件植入AI大脑,京东构建全链路布局推动AI走进家庭。
AI Labs 都在用,ClickHouse 能成为 AI 日志的实时分析引擎吗?
过去18个月,ClickHouse发展迅猛,2025年末ARR达1.6亿美元,付费云客户超3000。它原是Yandex项目,适合LLM推理日志分析。通过收购拓展为数据平台,进入多市场竞争。文章探讨其增长原因、产品、市场及优劣势等。
Cloudflare 构建了面向 LLM 的高性能基础设施
Cloudflare发布全新基础设施,可在全球边缘网络运行大型AI大语言模型。它将模型输入处理与输出生成拆分,自研Infire推理引擎,还推出Unweight模型压缩系统,分享提示词缓存优化方案。