人在回路」共找到 8730 篇相关文章

算法论文8

与DeepSeek-OCR不谋而合,NeurIPS论文提出让LLM像一样读长文本

NeurIPS 2025 论文提出 VIST 框架,为大语言模型长文本推理提供视觉方案,与 DeepSeek - OCR 理念不谋而合。它模仿类阅读,有快 - 慢路径协作,多任务表现优,还让模型‘用眼看文字’,优势明显。

机器之心
推荐文章7

如果你的大学不提供 Token,应该立即退学

本文站学生角度探讨 AI 时代大学生学习问题。认为高校 AI 教育上滞后,不提供 Token 不合理。强调学生应善用 AI,具备问题意识、判断力和品味,还给出了使用 AI 的具体建议。

特工宇宙
新闻资讯7

谢尔盖·布林重启「创始模式」?谷歌组建「突击队」,重押「AI编程」

近日媒体报道,谷歌组建由研究员和工程师构成的“突击队”,提升AI编程模型能力,推动编码工作自动化。谷歌创始谢尔盖・布林等参与其中,因Anthropic发布模型刺激,谷歌急起直追。

机器之心
新闻资讯8

AI不是比聪明,是输得起!菲尔兹奖得主点破OpenAI十项成果

OpenAI发布内部版模型Astra的十项成果,引发数学界震动。菲尔兹奖得主Timothy Gowers分析其成果,指出AI优势‘输得起’,还探讨找例方法、模型短板,给出训练建议与衡量跨越门槛的标准。

新智元
新闻资讯8

Claude Opus 4.7发布!这是你别的公众号看不到的五个发现

Anthropic发布Claude Opus 4.7,编码和视觉能力提升,但长上下文能力下降。其231页的System Card藏着不少有趣发现,如Opus 4.7非最强模型、Claude知道被测试、模型审查自身评估等。

花叔
推荐文章8

1500 个 PR、0 写代码:Codex 驱动的百万行级内部产品实践

团队五个月内开发并发布无工编写代码的内部测试产品,代码均由Codex生成,效率高。介绍了开发过程,如定义工程师角色、增加应用可读性等,还提及面临的挑战及解决办法,分享实践心得。

AI前线
新闻资讯7

2025年了,AI还看不懂时钟!90%都能答对,顶尖AI全军覆没

AI基准ClockBench测试AI读模拟时钟能力,类平均准确率89.1%,11个主流大模型最好仅13.3%。研究展示了LLM局限性,分析了可能原因,还对比了不同模型表现及各类问题上的差异。

新智元
新闻资讯7

只有5%AI项目挣钱!MIT最新报告印证奥特曼警告

MIT联合英伟达发布的AI商业分析报告显示,仅5%的AI项目能创造百万美元价值,其余亏损。AI项目落地难,因工具与场景有差距,企业自研成功率低,投资也偏向前端职能。

量子位
算法论文8

ICML 2025 | 大模型能信息不完备的情况下问出正确的问题吗?

当前大语言模型推理研究多聚焦被动推理,主动推理研究少,制约其现实场景应用。为此提出 AR - Bench 基准评估大模型主动推理能力,实验显示大模型主动推理能力严重不足,并指出后续拓展方向。

机器之心
产品应用7

10 1600 万美金 ARR,华团队 OpenArt 用了这 11 个 AI 技术栈

团队 OpenArt 10 团队做到 1600 万美金 ARR,CEO Coco Mao 分享经验。包括找准定位,聚焦三类核心用户;用程序化 SEO 实现增长;战略转型做视觉故事讲述;解决角色一致性问题,还介绍多方面技术栈。

投资实习所