「结构化评估」共找到 1779 篇相关文章
为什么 AI 搞不定体力活——对话清华大学刘嘉:这才是生物智能最难攻克的“万里长征” | 万有引力
本文是对清华大学刘嘉教授的访谈。他回顾 AI 研究经历,谈 AI 寒冬、研究错误及第一性原理,还分析学术界与工业界差异、AI 现状与挑战,指出大模型缺创造力,人应与 AI 共进化。
DeepMind 再放大招,AlphaGenome 能一次性处理百万碱基对,基因组里的“垃圾代码”这下藏不住了
Google DeepMind发布AI模型AlphaGenome,可预测遗传变异对基因调控的影响。它能处理百万碱基对,结合关键技术,性能顶尖,还能直接建模RNA剪接点,已面向非商业研究开放,引发医疗AI应用讨论。
ICML 2025 Oral工作再升级!上海AI Lab联合复旦、港中文推出支持更长视频理解的最佳工具VideoRoPE++
上海AI Lab联合复旦、港中文推出支持更长视频理解的工具VideoRoPE++。它确定了将RoPE应用于视频的关键特性,构建评测基准V - RULER,提出外推方案YaRN - V,在多任务中优于先前RoPE变体。
2.4k star 开源项目,Wingman AI + 知识图谱,如何帮你搭建‘私人大脑’?学术/项目必备,让笔记真正活起来!
MindForger是桌面Markdown IDE,可构建私人知识体系。它能本地运行,掌控数据,有思考联想、知识图谱浏览等功能,能解决笔记混乱等痛点,适用于学术、项目管理等场景。
北大DeepSeek论文或预定ACL Best Paper!梁文锋署名
北大DeepSeek联合发布的NSA论文已被ACL 2025录用且评分高,有望冲击最佳论文。该技术革新传统注意力机制,提升算力效率,是长文本处理的突破。此外,张铭教授团队还有多篇论文上榜。
OpenAI很看好!首个SWE-1模型发布,软件开发或将提速99%
Windsurf发布首个前沿模型SWE-1,目标将软件开发提速99%。它不只能写代码,还能协助软件工程流程。有三个系列模型,SWE-1运行成本低,SWE-1-lite对所有用户开放,SWE-1-mini适用于低延迟场景。
全球首次实测通过!CMU华人用AI设计的乐高「不翻车」
CMU研究人员提出LegoGPT,它微调Meta的LLaMA模型,结合47000个稳定结构数据集,确保98.8%的乐高设计符合物理定律,可实际搭建。目前,数据集、代码和模型均已开源。
关于 AI 编程的最本质提问:Cursor 到底有没有护城河?
文章剖析了Cursor崛起原因、“护城河”及挑战。其“护城河”有产品粘性、高度集成和先发优势,但面临大模型“商品化”和众多模仿者挑战。还给出深化“护城河”建议,最终能否胜出待时间检验。
AI Infra 正在诞生自己的石油期货?GPU 不够买之后,华尔街开始交易算力
AI 行业焦点从 GPU 够不够用转向算力定价。2026 年 8 月 CFTC 就算力衍生品公开征求意见,CME 与 Silicon Data 计划推期货产品。但 GPU 算力金融化面临标准化、衡量方式等难题。
黎曼猜想推至理论边界99.55%!元代理架构AI:在思考中重塑大脑
科学家面临让AI解决复杂科学难题的问题,传统固定架构AI处理特定复杂问题不顺手。近日学术团队提出Eureka架构,能让AI动态“生长”专用“大脑”,在测试中表现出色,还在数学和物理领域有重大成果。