百小医」共找到 1106 篇相关文章

推荐文章7

与三位前沿研究者聊AI Agent:规则、环境与热潮下的真问题|五源酒馆Vol.31

五源酒馆对话三位AI Agent前沿研究者,探讨其发展进展、挑战。他们分享对Agent定义、能力边界判断等,提及过去技术突破,如DeepSeek工作,也指出通用Agent瓶颈,探讨未来模型能否提有价值问题等。

五源资本 5Y Capital
开源动态8

红书hi lab首次开源文本大模型,训练资源不到Qwen2.5 72B 的四分之一

6月6日,红书hi lab团队首次开源文本大模型dots.llm1,采用MIT许可证。该模型激活参数量140亿,总参数量1420亿,上下文长度32K。训练资源不到Qwen2.5 72B的四分之一,在多个测评中表现出色。

AI前线
新闻资讯8

Jason Wei也被扎带走:思维链开创者、o1系列奠基人!这次真挖到OpenAI大动脉了

思维链提出者、o1系列模型关键人物Jason Wei被曝将入职Meta,o1另一位关键人物Hyung Won Chung也可能被挖走。扎为顶尖AI人才提供强大支持,而OpenAI内部也存在增长混乱等问题。

量子位
产品应用7

看到这个红书卖虚拟产品获利万的案例,我才发现AI翻译的信息差真大

作者建议AI开发者先了解大众需求再做产品。分享红书上AI翻译变现案例,还展示智谱BigModel开放平台翻译智能体的多模态翻译案例,介绍其解决AI翻译问题的亮点及适用场景。

花叔
开源动态8

8B模型任务击败GPT-5?阶跃星辰开源Deep Think新框架,模型解锁万Token测试时计算

阶跃星辰推出并行协同推理框架PaCoRe,让大模型突破上下文窗口和处理速度限制。基于此框架,模型能解锁万级Token测试时计算。PaCoRe - 8B在数学基准测试中超越GPT - 5,还具备前沿性能、“综合”能力涌现等优势。

机器之心
开源动态8

不用千亿参数也能合成高质量数据!这个开源框架让模型“组团逆袭”,7B性能直追72B

上海人工智能实验室与中国人民大学提出GRA框架,以“多人协作”理念让模型分工生成高质量训练数据。实验显示其生成数据质量高,项目已开源。它打破对大模型蒸馏依赖,展现“集体智能”潜力。

量子位
开源动态8

阿里通义开源「推理+搜索」预训练新框架:模型媲美大模型,多个开放域问答数据集表现显著提升

阿里通义实验室开源通用预训练框架MaskSearch,引入检索增强型掩码预测任务,兼容两种训练方法。实验显示,它在多数据集提升模型性能,模型能媲美大模型,还验证了训练方式、策略及奖励函数的效果。

量子位
推荐文章7

如何让Agent更符合预期?基于上下文工程和多智能体构建云二Aivis的十大实战经验

文章围绕云二Aivis项目,分析Agent不按预期输出的原因,从预期和技术层面展开。还总结十大优化经验,如清晰预期、精准投喂上下文等,为构建和调优Agent提供参考。

阿里云开发者
新闻资讯7

7B模型超越DeepSeek-R1:模仿人类教师,弱模型也能教出强推理LLM | Transformer作者团队

Transformer作者之一创立的Sakana AI带来新方法,让教师模型像人类教师一样做启发式教学,根据已知解决方案输出解释。用此方法训练的7B模型在传授推理技能上比671B的DeepSeek - R1更有效。

量子位
产品应用7

我用扣子空间制作了档宇宙播客《语出惊人》,借AI之口犀利对谈人生困境,效果惊艳

作者在All in AI后运营AI Reading Hub公众号,有每日文章和语出惊人两个板块。体验notebooklm后,用扣子空间制作宇宙播客《语出惊人》,借AI探讨年轻人关注问题,后续会持续更新。

AI Reading Hub