「市场验证」共找到 1449 篇相关文章
全球首个通用决策大模型,AI推演现实世界的技术揭秘
中科闻歌决策机Decitron被称为「全球首个通用决策大模型」,它将不同能力统一到开放世界决策框架,形成闭环。8月3日其技术报告发布,公开三项核心技术,还介绍了推演流程和实验验证情况。
完成20亿的融资,这家AI芯片公司也要冲击IPO
近日,AI芯片企业清微智能完成超20亿人民币C轮融资,已启动上市筹备。该公司是可重构计算领导企业,量产多款芯片,与智源研究院合作打造国产AI芯片软件生态,市场表现佳。
推理即排序:ReasonRank反常识的2.7倍效率跃迁,新SOTA比快更快
论文提出新型排序模型ReasonRank,将深度推理能力融入排序流程,突破数据瓶颈,采用创新训练框架,效率比主流点对点排序模型快2.7倍,还介绍方法论、技术突破、实验验证等内容,指出局限与未来方向。
用中等难度prompt做高效post training
近年来,RL后训练在LLM发展中至关重要,但传统方法效率低。本文提出PCL轻量级算法,通过动态选中等难度提示提升LLM后训练效率,经多基准实验验证其优越性,也指出方法局限与未来方向。
AI 的「成本」,正在把所有人都拖下水
文章指出,虽大模型成本下降,但 AI 公司仍难盈利。因市场追逐新模型,且模型消耗算力单位剧增。如 Anthropic 的不限量套餐失败,各公司陷入囚徒困境,还给出按使用量计费等破局思路。
ACL'25最佳论文解读 | 大模型也会‘弹簧回弹’?揭秘 LLM 对齐的脆弱根源
本文分享 ACL 2025 最佳论文,指出预训练大模型存在‘抗对齐’的 Elasticity 现象,即对齐微调只是暂时拉伸,后续微调会让其迅速弹回预训练分布。研究量化该概念,用‘压缩理论’刻画对齐并实验验证。
AI搜索平台Glean获1.5亿美元,估值72亿美元
CNBC消息,AI搜索平台Glean完成1.5亿美元F轮融资,估值升至72亿美元。其核心产品是企业级搜索平台,可集成多应用。资金将用于团队扩张和拓展市场,但也面临激烈竞争,技术可与大模型互补。
刚刚,全球最难考试惊天大反转!黑马AI冲破36%,顶流模型集体翻车
ARC-AGI-3测试中,顶级大模型Opus 4.6仅得0.2%,人类获满分。而Symbolica公司用Agentica框架首日就取得36.08%的成绩。该框架有独特技术路径和策略,但成绩未经验证,ARC-AGI-3被视为通向AGI的‘北极星’。
暴涨3倍!光模块背后大赢家
2025年源杰科技股价表现强劲,年初迄今涨幅达348%,反超下游大客户中际旭创。其前三季度业绩爆发,得益于数据中心市场产品放量。随着AI算力需求爆发,光互连技术向CPO架构演进,对光芯片要求提高,源杰科技高端产品突破助其获利。
自写驱动越狱!Gemini 3 Pro零败绩通关宝可梦:效率碾压前代8倍「Agent进化太快了」
在全自动《宝可梦 水晶版》对决中,Gemini 3 Pro击败Gemini 2.5 Pro,通关速度至少快2倍,前代或慢8倍。它还展现出诸多能力,如自写驱动绕过限制等,但也存在不验证假设等局限。