「系统编程语言」共找到 3587 篇相关文章
准确率轻松翻倍!不烧钱微调,AI靠“写日记”实现能力跃升
Memento - Skills系统抛弃大量算力微调模型参数的方式,靠读写反思、“写日记”式学习机制,在不改变模型参数下实现能力跃升,在GAIA和HLE基准实验中准确率显著提高。
GPT-5,AI的「登月时刻」来了!奥特曼现场发布,三位一体博士级智能体
GPT-5正式发布,它是融合模型,准确性大幅提升,编程、写作等能力飞跃,语音模式升级,还有个性化功能,已介入医疗。API含三款模型,价格有竞争力,标志AI竞争转向「智能发布」。
ACL首届博士论文奖公布,华人学者李曼玲获荣誉提名
自然语言处理顶会 ACL 公布首届计算语言学博士论文奖,获奖者是华盛顿大学的 Sewon Min,其论文聚焦大型语言模型数据使用。此外,还有三篇论文获提名,包括李曼玲等学者的成果。
从 Hadoop 到 Kubernetes:Pinterest 在 AWS EKS 上的可扩展 Spark 架构
Pinterest将基于Hadoop的数据平台替换为Moka,这是在AWS EKS上运行Spark的Kubernetes原生系统。Moka实现容器化作业隔离,支持ARM实例,改进调度、简化部署,降低成本、提高效率。
快慢Reasoning综述!
大型语言模型在复杂推理任务中有‘无差别计算’缺陷,阻碍其在多场景应用。本文提出双层效率优化框架,梳理两类前沿技术,通过实验揭示瓶颈,为轻量化推理指明路径。
斩获20K星!再见PDF排版噩梦,这个开源神器让文档处理爽到飞起!
MinerU是上海人工智能实验室推出的开源数据提取工具,能将多模态文档解析为Markdown,支持精准提取图片、表格、公式,具有多语言支持、高性能等特点,应用场景广泛,还开源免费。
微软:LLM上下文学习并非真的学习!
微软研究指出大模型上下文学习(ICL)虽数学上符合学习定义,但只是拟合prompt内统计规律,非掌握任务本质。通过大量实验,得出如例子越多模型表现越好、语言不重要统计重要等7条关键发现。
Fable 5 刚被封杀,OpenRouter 用「多模型协作」搞出了「平替天团」
2026年6月14日,OpenRouter推出复合模型Fusion API,可复刻Claude Fable 5智力水平。它采用多模型协作,经DRACO测试效果出色,成本减半,但也有编程不实用、速度慢、数据合规存黑箱等问题,重塑了AI行业逻辑。
我用MiniMax Agent开发了个带后端的全栈网站,全程0代码
2025年Agent成AI领域焦点,大厂纷纷布局。作者测试MiniMax Agent,发现其有四大特点:深度研究和上下文管理强,多模态输出出色,编程能力超预期,能执行定时任务,还能开发带后端的全栈网站。
美国ATOM报告:Qwen称霸武林,中国统治开源世界
美国ATOM报告显示,2025年夏中国开源语言模型超美国,下载、使用量差距显著。Qwen成王者,DeepSeek在大模型领域表现出色。新势力如Nvidia、OpenAI等也在追赶,报告引入新指标衡量模型热度。