模型调用」共找到 7872 篇相关文章

新闻资讯7

双“雷”暴击!Trae 被曝资源黑洞、Claude背刺超级付费党,开发者们被“刀”惨了

主打“自动化执行、多模型调用、上下文记忆”的AI编程应用大热,但也出现运行卡顿等问题。Trae被曝过度消耗资源,Claude Code对付费用户增加调用限制,凸显AI产品资源问题及厂商成本管控困境。

AI前线
产品应用7

用 Ollama 本地运行 OpenAI gpt-oss 官方完整教程

OpenAI出教程教用Ollama本地部署gpt-oss-20b或gpt-oss-120b,可实现离线对话、API调用等。介绍模型版本、硬件要求、安装设置,还提及对话、API使用、工具调用、与Agents SDK集成等内容。

AI工程化
算法论文7

OpenAI和Anthropic费尽心机加密的思维链,竟然能被轻松提取?

围绕大模型蒸馏争议已久,此前外部团队难获闭源模型完整推理。8 月 10 日研究者公开方法,可让弱模型读取旗舰模型密文并输出推理,还发现公开智能体轨迹存在隐私泄露问题,不过未为蒸馏指控提供决定性证据。

DeepTech深科技
新闻资讯8

2025年4月17日消息,OpenAI 连发o3和o4 mini,o3为强大推理模型,o4-mini专为高效推理优化。它们能调用ChatGPT工具,可基于图像思考。OpenAI还开源本地代码智能体Codex CLI,兼容所有模型

鱼羊
新闻资讯7

揭密MiniMax不为人知的B面

第一批AI大模型公司上市潮来临,MiniMax营收增长显著。它采用“B+C全都要”商业模式,B端业务靠API调用,覆盖多领域,毛利率高。其B端战略分三层,靠全模态布局和模型能力扩张版图。

芯师爷
算法论文7

LLM加RL遭质疑:故意用错奖励,数学基准也显著提升,AI圈炸了

华盛顿大学等机构论文引爆AI界,其发现用虚假奖励训练Qwen2.5-Math-7B模型,也能提高MATH - 500成绩。虚假奖励对Qwen模型有效,但在其他模型上有限,凸显RLVR有效性与模型能力有关。

机器之心
新闻资讯7

老外给中国 AI 开源厂商打分:第一梯队是 DeepSeek 和 Qwen。

Nathan Lambert发布“中国开源模型开发商排名”,评估19家实验室贡献,第一梯队是DeepSeek和Qwen。还介绍字节跳动豆包、小米、百度文心一言发展情况,如豆包月活全球第二,小米模型效率突破,文心一言企业应用领先。

AI进修生
开源动态8

刚刚,DeepSeek多模态技术范式公布,以视觉原语思考

DeepSeek发布多模态模型并公布技术报告,提出‘以视觉原语思考’。该模型解决多模态大模型‘指代鸿沟’问题,有把坐标变思维单元、7056倍视觉压缩、精心设计冷启动数据等创新,实验在多任务上超主流模型

机器之心
开源动态7

DeepSeek V3.1 把 R1 融了,一堆新活:<think>开关、动态搜索、新ToolCall ...

DeepSeek在Hugging Face悄悄发布V3.1版本,将对话和推理模型合并为混合推理模型。它有显式推理、内置搜索、简化工具调用等特性,Aider测试成绩佳且成本低,但也存在战术回避、幻觉率升高等问题。

探索AGI
新闻资讯8

MLLM集体翻车,缺乏婴儿级常识!业界首个核心认知基准发布,LeCun转赞

当前大模型在12项核心认知上普遍落后人类10 - 30%,越大的模型越易靠「背答案」糊弄。团队公开首个系统评测框架和题库,用Concept Hacking方法识破模型真假理解,指出模型存在核心知识缺失等问题。

新智元