「高质量输入」共找到 2440 篇相关文章
1万tokens是检验长文本的新基准,超过后18款大模型集体失智
Chroma团队研究发现,将上下文扩展至1万tokens,18款主流大模型集体“失智”,“智商”非均匀下降,在一些节点会断崖式下跌。研究还设计四项对照实验,证明LLMs性能随输入长度增加显著且非均匀下降。
ChatGPT又突发俩CEO了?纯属扯淡,根本啥大洗牌
The Verge报道,前Meta高管Fidji Simo将以应用线CEO身份接手ChatGPT等业务。这并非大洗牌,而是OpenAI强化产品端能力的举措。此次调整像架构重构,还可能带来商业化变化,也被视为IPO预备动作。
一句“Hi”,80$蒸发!O3-Pro:地表最强,也最“坑”的AI!
昨晚ChatGPT宕机,OpenAI 2折甩卖o3模型并发布o3 Pro。o3 Pro编程能力强,达全球top150程序员水准。官方称甩卖的o3是原版但推理快近40%。o3使用成本高,还需足够上下文。
多模态扩散模型开始爆发,这次是高速可控还能学习推理的LaViDa
近期基于扩散模型的视觉 - 语言模型 LaViDa 出现,它继承扩散语言模型优点。与自回归模型不同,扩散模型能并行、处理双向上下文。LaViDa 在多任务测试有竞争力,推理蒸馏和文本填空表现好,还能权衡速度与质量。
Cursor发布Composer 2:专攻代码的模型,价格只有GPT-5的零头
Cursor本周发布自研编程模型Composer 2,只攻代码生成。其得分提升,超Claude Opus 4.6,接近GPT - 5.4 Thinking。训练基于代码数据,处理复杂编程任务准确度高,价格远低于竞品。这是Cursor全栈布局,欲掌握AI编程主动权。
谷歌Gemini最强性价比模型发布,1块8读完3本三体
谷歌推出Gemini 3.1 Flash-Lite,号称性价比最高的Gemini 3系列模型,每百万输入token仅0.25美元,读完3本《三体》只需1.8元。性能表现佳,还支持可调思考层级。两小时后ChatGPT推出GPT - 5.3 Instant回应。
王兴一鸣惊人!美团首个开源大模型追平DeepSeek-V3.1
美团首个开源大模型Longcat-Flash-Chat发布即引发热议。它在部分benchmark上超DeepSeek-V3.1等,编程能力也出色。技术报告透露美团对大模型的理解,还有新发现,且性能好、训练效率高。
爽!AI编程2年半,终于用上了喂饭级的API!
作者分享对接智谱API的超爽体验,5分钟搞定。强调在Agent工作流里文档质量影响成功率,对比某作图API凸显差距。指出2025年后AI Agent成API主要用户,智谱和Cloudflare站对边,体现Agent First思维。
MIT & Google | 提出异步并行生成新范式,LLM推理效率大幅提升!
MIT与谷歌团队在研究PASTA中探索异步生成范式,开发标记语言PASTA - LANG,采用双阶段训练流程,设计推理系统。实验显示PASTA平衡性能与质量,有可扩展性,为LLM推理效率优化开创学习驱动新路径。
DeepSeek之后,中国AI「自己出题」杀进Nature通讯!全球仅4家
一家成立不到两年的香港AI公司维纳智能,不堆参数、不依赖人工标注,靠让大模型自动生成高精度推理数据登上Nature通讯。其技术可解决Agent泛滥的困局,还推出特色产品,业务增长快。