预取」共找到 378 篇相关文章

开源动态8

告别单兵作战!这个Python语言驱动的AI智能体集群框架火了,30+工具一键调用!

团队开源了Python语言驱动的AI Agents开发框架Strands Agents Tools,提供30+构建工具,支持多场景,降低开发门槛,为复杂任务调度和系统调用提供解决方案。

开源星探
产品应用7

Perplexity不仅没死,而且很强

文章对比通用AI搜索与Perplexity,指出通用AI搜索用于金融投资不够严谨准确,而Perplexity从专业金融API拉数据,集成权威数据源,准确度高。在此基础上推出的Perplexity Computer功能强大,是严肃工具。

newtype AI
新闻资讯7

个人开发者训400亿参数大模型:分布式算力,DeepSeek架构,3090单卡部署

Nous Research推出Psyche Network,可整合全球算力训练AI。它基于Deepseek的V3 MLA架构,有DisTrO优化器等技术,能让个人和小团体创建大规模模型,还实现40B参数LLM训练。

量子位
新闻资讯8

黄仁勋暴论核弹:AGI已经实现,Ilya错了,程序员有10亿

在Lex Fridman的专访中,黄仁勋抛出诸多惊人观点,如称已实现AGI,反驳Ilya“训练触顶”言论,认为推理计算难且重要,还对未来技术、行业、职业发展等多方面进行展望。

量子位
算法论文7

AI穿越战争迷雾,72%的准确率化身中东冲突言家

阿联酋和美国研究人员用中东冲突测试AI推理表现,发现其能看透利益博弈、判战局演变。AI擅沿客观限制推演,在经济领域敏锐,政治领域较难,整体测准确率达72%。

AIGC开放社区
算法论文8

OpenAI解释LLM为什么会有幻觉

OpenAI和佐治亚理工联合论文《Why Language Models Hallucinate》深入探讨LLM幻觉根源,指出训练阶段统计本质和评估体系激励扭曲是主因,还提出改革评估体系引入显式置信度目标的解决方案。

深度学习自然语言处理
开源动态8

智源研究院发布中英文高质量数据集CCI4.0,推动全球人工智能开源创新

2025年5月6日,智源研究院在全球开源创新论坛发布中英文高质量数据集CCI 4.0,同步在多平台开源。CCI 4.0规模大,处理严格,此前CCI系列反响好,未来将持续建设中文训练语料库。

AI科技大本营
开源动态8

Google开源黑科技!不用训练的时间序列测模型,17.9K Star 疯狂追捧!

Google Research团队开源的TimesFM时间序列测模型获17.9K Star。它零训练、开箱即用,基于1000亿时间点训练,涵盖多场景数据,还能给出置信区间,已集成到Google多个产品。

开源星探
推荐文章7

听说,大家都在梭后训练?最佳指南来了

大模型时代,Scaling Law 边际效益递减,业界转向后训练。《Post-training 101》博客可助初学者入门,涵盖从训练到指令微调、SFT 原理、多种强化学习技术及模型评测方法等内容。

机器之心
开源动态8

数据减少超千倍,500 美金就可训练一流视频模型,港城、华为Pusa来了

香港城市大学与华为香港研究所合作推出 Pusa 项目,它基于 FVDM 理论,可极低成本微调大规模训练视频模型,成本降超 200 倍、数据减少超 2500 倍,代码已开源。

机器之心