「置信度指标」共找到 600 篇相关文章
Gemini 3“超前点映”效果炸场,巴菲特305亿重仓谷歌
Gemini 3还未正式发布,“超前点映”已亮相,网友实测其表现超强,能完成多种复杂任务。关注度火热,谷歌CEO还转发相关猜猜乐消息。同时,巴菲特305亿重仓谷歌,据传因提前体验Gemini 3。
国产模拟芯片迎来升维关键时刻
企业上半年财报显示,2025年模拟芯片正走出周期性低谷。国内厂商面向新兴场景,从多维度创新,向高端领域渗透,但在高端市场、产品矩阵、人才和生态方面与国际企业有差距,需把握创新方向。
DeepSeek不惜代价保住它!V4关键特性被挖出来了
DeepSeek V4技术报告被深挖,为保留核心设计「batch invariance」不惜代价。该设计能保证线上推理稳定、各环节对齐,是复杂上下文系统底座,但会牺牲GPU利用率等,换来训练等多阶段可复现和稳定度。
Manus 对谈 YouTube 联创陈士骏:两代创业者聊 AI 创业和长期主义
本文是 Manus 联合创始人与 YouTube 联创陈士骏的对谈,涉及 AI 创业和长期主义。探讨了产品优先级确定、核心指标、竞争应对、用户留存等,还谈及硅谷创业生态及 YouTube 发展历程与收购故事。
刚刚,Opus 5来了:性能不输 Fable 5、价格砍半
Anthropic 发布新一代模型 Claude Opus 5,其智能接近 Claude Fable 5 但价格减半。它在编程、知识工作等评测中表现出色,科研能力进步大,自主性与严谨性更强,安全对齐度高,防护兼顾安全与可用。
图像编辑太慢太粗糙?全新开源自回归模型实现精准秒级修改 | 智象未来
AI图像编辑中扩散模型有两大难题,智象未来团队提出全新自回归图像编辑框架VAREdit,引入视觉自回归架构,提升编辑精准度与速度。模型和代码已开源,还提出SAR模块优化,在基准测试表现出色。
Cache Me If You Can:陈丹琦团队如何「抓住」关键缓存,解放LLM内存?
普林斯顿大学陈丹琦团队新论文聚焦长上下文语言模型 KV 缓存问题。传统 KV 缓存大小随输入文本长度线性增长,此前方法难公平比较。团队提出「KV 足迹」指标,改进方法并推出 PruLong 优化内存,节省空间且保性能。
“甲方快乐模型”诞生,拿下平面设计新SOTA!多条件一键生成,还能独立调整元素 | 复旦&字节
复旦大学和字节跳动团队联合提出CreatiDesign新模型,可实现高精度、多模态、可编辑的AI图形设计生成。它解决了以往方法在处理图形设计时的难题,在多维度评估基准上表现出色,还支持多轮编辑。
论文秒变海报!开源框架PosterAgent一键生成顶会级学术Poster
本文介绍开源框架PosterAgent,它能一键将论文转为可编辑的学术海报。相比GPT - 4o,其生成指标优、token使用量少、成本低。研究团队构建评估标准Paper2Poster,实验显示PosterAgent在多方面表现出色。
ICML 2026 | 西湖大学提出 PiEvo:基于原理进化的科学发现智能体框架
西湖大学研究团队提出PiEvo框架,将科学发现重点从“搜索假设”转变为“进化科学原理”,通过不确定性最小化实现原理空间自主扩展。该框架构建双循环优化机制,实验结果显示其核心指标超越SOTA,收敛速度大幅提升。