「多语言数据集」共找到 6587 篇相关文章
AI“压力面”,DeepSeek性能暴跌近30% | 清华&上海AI Lab
上海人工智能实验室等团队设计REST框架,在一个prompt里抛多个问题模拟多任务推理场景。测试发现即便顶级模型如DeepSeek - R1在“高压”下准确率也骤降,该框架能揭示模型差异,为评测提供新范式。
Unify:9个月两轮融资估值2.6亿美元,AI 自动化销售赛道跑出新独角兽
AI销售自动化平台Unify完成4000万美元B轮融资,投后估值2.6亿美元。其核心产品解决销售数据孤岛等痛点,20 - 30%营收来自自用。虽面临竞争,但有独特优势,未来挑战与机遇并存。
黄仁勋中国现场直击!假如有一个「数字黄仁勋」,我希望我们一起变聪明
英伟达CEO黄仁勋再访北京,接受新智元等媒体采访。他盛赞华为优秀,评价DeepSeek等模型出色,还谈及AGI、数字分身、出口管制等话题。此外,H20芯片解禁重售释放政策信号,有望实现中美科技企业合作共赢。
打造全球首个强化学习云平台,九章云极是如何做到的?
AI正从语言模型走向智能体,强化学习成关键技术,但训练面临困难。2025年6月九章云极发布全球首个工业级强化学习云平台AgentiCTRL,实现系统级重构,其智能基础设施战略布局领先,具产业赋能优势。
普林斯顿等高校提出AgentDistill:无需任何训练即可继承大Agent复杂能力,性能提升48%,成本降低90%
在AI领域,大型语言模型智能体计算需求大限制部署,传统蒸馏技术对智能体效果有限。AgentDistill提出解决方案,让学生智能体复用教师智能体的MCP工具包,无需训练继承复杂能力,小模型性能显著提升。
本地LLM万字救场指南来了!全网超全AI实测:4卡狂飙70B大模型
文章围绕本地大语言模型(LLM)展开,针对实用性和经济性问题,用Dell Precision 7960塔式工作站对主流模型测试。涉及不同尺寸模型、推理框架等,给出不同配置下性能指标及使用建议,还模拟真实场景测试。
苹果或搁置自研模型,转向依赖OpenAI或Anthropic
苹果正考虑用第三方AI模型驱动Siri,这是其在AI竞赛中的重大转向。目前苹果多为自研技术,评估外部模型项目已启动,虽未做最终决定,但或借此摆脱AI落后声誉。网友对此看法不一。
TRAE 如何思考 AI Coding :未来的 AI IDE,是构建真正的「AI 工程师」
越来越多玩家涌入AI Coding赛道,TRAE作为国内首个AI Native的IDE有独特想法。其产品经理Leon认为未来是「AI+工具」模式,推出Solo模式,还分享相关思考、功能及场景,TRAE月活已超百万。
模型即 Agent 的含金量:Kimi深度研究功能详评
作者分享Kimi深度研究功能体验。其基于端到端自主强化学习技术,会开源模型。在测试中,分析Labubu爆火原因、检索小米发布会内容,展现出强逻辑分析、搜索准确性和数据处理能力,可视化网页也出色。
纳米 AI 梁志辉:超级搜索智能体是 AI 时代的真正入口
纳米AI梁志辉认为超级搜索智能体是AI时代真正入口。纳米AI推出的「超级搜索智能体」结合多Agent协作等能力,是新解决方案。演讲分享了360对AI搜索、智能体搭建及浏览器的看法与探索。