是石科技」共找到 4773 篇相关文章

算法论文8

GPT-5都救不了的AI幻觉,原来问题不在模型,在“考卷”

OpenAI研究指出AI产生幻觉的根本原因评估和激励机制有问题。现有训练和评估流程奖励‘猜测’,导致模型易产生幻觉。研究还给出解决方案,要更新‘考试规则’,让模型适当表达不确定。

AIGC开放社区
新闻资讯7

奥特曼无能,英伟达撤单OpenAI投资?黄仁勋街头回应了

有传闻称英伟达与OpenAI千亿美元合作停滞,黄仁勋私下吐槽奥特曼。但黄仁勋街头回应否认,称看好OpenAI,会参与其最新一轮融资且可能最大投资。双方合作超十年,此次表态意味着合作将继续。

量子位
推荐文章8

MCP 和 Skills 到底什么区别?一篇文章说清楚

文章解释了 MCP 和 Skills 的区别。MCP AI 世界的 USB 协议,可降低开发成本,但会吃掉上下文窗口;Skills 采用渐进式披露设计,自带脚本,能减少上下文消耗。未来 Skills 或承担多数工作,MCP 用于远程连接。

宝玉AI
算法论文8

Anthropic:上下文工程在AI Agents的正确打开方式!

在‘提示工程’后,‘上下文工程’成焦点。它提示工程延伸,因信息过多模型会‘失焦’,上下文稀缺资源。文章介绍高效上下文‘解剖学’、运行时检索策略、长周期任务应对方法等。

PaperAgent
8

AI教父Geoffrey Hinton,全球第二个百万引用科学家!

AI教父Geoffrey Hinton论文被引数破百万,成全球第二人。其代表作如AlexNet、Deep Learning等影响深远,覆盖理论、技巧等层面,支撑大模型运行。他还称大模型黑箱,领域待探索。

新智元
开源动态7

卷疯了!2.2k Star通用型、开源Agent平替Manus、GenSpark AI

2025 年 Agent 之年,文中介绍了 Manus、GenSpark AI 两款闭源代理,还重点阐述开源的 II - Agent,它功能丰富,架构设计合理,在 GAIA 基准测试评估,性能可平替前两者。

CourseAI
产品应用8

Claude 4发布!AI编程新基准、连续编码7小时,混合模型、上下文能力大突破

今天凌晨Anthropic开发者大会发布Claude 4,含Claude Opus 4和Claude Sonnet 4。前者顶尖编码模型,后者Sonnet 3.7重大升级。还发布系列产品,定价不变,已上线Amazon Bedrock。

Founder Park
新闻资讯7

老黄唱衰编程,GitHub CEO硬刚:放弃写代码等于放弃智能体未来话语权

GitHub CEO托马斯·多姆克在采访中反驳“编程无用论”,认为2025年编程智能体之年,但未来仍属人类程序员。公司推出多个SWE智能体产品,Copilot用户增长显著,还将评估商业模式,专注打造最佳产品。

量子位
算法论文8

微软:DeepSeek-R1等推理模型循环的原因找到了

前几天,DeepSeek - R1论文更新,披露诸多细节。重点推理模型在低温/贪心解码下易循环,根源学得不对,如风险规避式复读、时序相关错误复读,还给出解决方案。

PaperAgent
开源动态8

找到啦,我们已上车,Github 27000+ star,研发团队必备开源工具项目,真丝滑!!!

Trivy开源安全扫描工具,支持扫描容器镜像等目标,识别CVE漏洞等风险。它有6大突出功能,技术优势明显,还给出使用示例、应用场景,与传统工具对比优势显著,适用于全生命周期安全分析。

小华同学ai