「科研Agent」共找到 3027 篇相关文章
别问树模型了!死磕结构化数据,清华团队把大模型表格理解推到极限
AI 时代处理结构化数据成痛点,LLM 大模型难以满足生产要求。清华大学与稳准智能联合发布的 LimiX 系列模型,做到真正通用,在跑分和实际落地表现出色,其轻量级版本 LimiX - 2M 适合边缘设备和科研场景。
如何让AI帮你做前端自动化测试?我们这样落地了
本文介绍阿里基于AI的UI自动化测试框架在专有云质量保障的实践。框架用开源browser - use等工具,采用自然语言驱动用例、动态元素定位等机制,还应对了大模型幻觉等挑战,也提及构建企业级数据分析Agent方案。
奥特曼和纳德拉,艰难重组后首次对谈:「我们是天作之合!」
奥特曼与纳德拉在OpenAI重组后首次同台,阐释重组幕后并押注从App到Agent的范式迁移与Copilot落地。新协议让OpenAI完成重组,Azure成AI开发者“圣地”,双方合作影响软件范式、人机交互及产业格局。
“你以为买的是 DeepSeek Flash,到手可能是 1.5 bit 缩水版”:Pi 核心贡献者谈 AI Token 黑箱
Pi 核心贡献者 Armin Ronacher 与 Modem 联合创始人 Ben Vinegar 播客对谈指出,当前 AI token 市场不透明,模型公司或失控。如买 token 像买成分不明商品,模型训练目标不明,且 Agent 行为边界在扩展,问责制缺失。
Anthropic让AI先读员工手册再上岗:失控率从54%降到7%
Anthropic最新研究「模型规范中期训练」(MSM)显示,相同训练数据配不同行事原则,模型表现不同。MSM在预训练和对齐微调间加中间阶段,让模型读规范文档理解准则,在特定实验中,将Agent失控率从54%降到7%。
万字实录:AI究竟是普通人的“印钞机”,还是更狠的「收割机」?| GAIR Live 021
雷峰网&AI科技评论邀三位老师探讨“AI大模型金融应用的机遇与挑战”。以Trading Arena大赛为例,分析大模型在金融投资应用,指出打造强逻辑推理“大脑”是金融应用关键,也提及Agent局限与“黑天鹅”预判路径等。
陶哲轩亲测!GPT-5 Pro 40分钟破解3年难题,登顶最难数学考试
数学家陶哲轩将几何难题交给GPT - 5 Pro,虽推理完美但无解。同一周,GPT - 5 Pro在FrontierMath测试集夺冠。陶哲轩测试发现AI在科研不同层面表现有别,也揭示了AI理解力受限及人类与AI的分工边界。
GPT-5被批过度炒作、性能落后,OpenAI联创揭秘其中原因:我们把它关在 “象牙塔”,和现实世界接触不够
OpenAI 发布 GPT - 5 进军企业市场,虽发布不顺利,但部分初创公司和企业客户反馈其在复杂任务表现出色、价格低廉。OpenAI 联创 Greg Brockman 揭秘 GPT - 5,称其代表‘几乎难以形容的智能’,是科研好伙伴,还探讨算力、模型训练等问题。
吃灰 AI 眼镜爆改“交警 Copilot”,函数计算AgentRun 实操记录
作者将吃灰的Meta Ray - ban眼镜爆改成“交警Copilot”,介绍了“端 - 管 - 云”协同框架,分享客户端与服务端开发过程。还探讨用Agent架构和FaaS的原因,指出其在应对需求变化、节省成本等方面优势,最后提及项目待优化处。
AI科学家登场!12小时抵人类科学家半年工作量,已有7项大成果
OpenAI CEO奥特曼期待GPT - 6实现「AI创造新科学」,类「AI科学家」Kosmos登场。它12小时完成人类半年工作量,有7项成果,能自主规划,从工具迈向合作者,但约20%结论需人类裁判,人机协作或重塑科研。