「科学推理能力」共找到 4767 篇相关文章
国产大模型「五强争霸」,决战AGI!
中国基础大模型市场形成「基模五强」格局,包括字节、阿里、阶跃星辰、智谱和DeepSeek。它们要么有钱,要么有人,各有特色与优势。未来竞争焦点是追求更高「智能上限」和突破「多模态能力」,决战AGI。
0人类数据,让机器臂自学拧灯泡:MIT初创要打造机器人界的AlphaZero
Eka Robotics 发布机械臂视频,其能自主拧灯泡、抓取物品。该公司提出 VFA 模型,不依赖人类数据,让机器人在仿真环境自主探索。创始人期望实现超人级灵巧操作,算法还展现泛化和自主发明策略能力。
再不怕乱引文献!绕过付费墙,BibAgent把学术核验转为证据链
大模型生成学术论述,其引用验证成难题,尤其付费墙后论文难以核验。BIBAGENT突破此困境,不破解付费墙也能验证引文语义真伪,还构建MISCITEBENCH评测,表现优异,为科学写作补“可审计基础设施”。
源神阿里!图像生成Ovis-Image再开源,7B小参数媲美GPT-4o和20B开源模型
阿里Ovis团队发布Ovis - Image,7B参数文本到图像模型,在文本渲染任务媲美GPT - 4o和20B + 开源模型。它架构优化、数据工程精细、训练范式独特,实测数据表现佳,显存占用低、推理快。
Lumina-mGPT 2.0:自回归模型华丽复兴,媲美顶尖扩散模型
上海人工智能实验室等团队提出Lumina - mGPT 2.0自回归模型,统一多种图像任务。它采用独立训练架构、统一多任务处理框架和高效推理策略,实验表现优异,后续将优化采样时间并扩展至多模态理解。
谷歌开发者大会炸场!Agent重磅升级, A2A、SDK大更新
今天凌晨谷歌召开‘I/O 2025’开发者大会,对Agent智能体重磅升级。A2A协议更新,新增关键功能,还发布官方Python SDK;生态持续扩大,多家名企加入。此外,发布Agent Engine UI,升级Agent SDK,增强Project Mariner能力。
对谈openai首席产品,AI时代的产品思路。
知名播客主理人Lenny对OpenAI CPO Kevin Weil进行访谈,分享了OpenAI内部的产品哲学,包括Model Maximalism、Iterative Deployment、Evals等方法论,还谈及AI技术演进、未来机遇等思考,鼓励培养核心能力应对AI变革。
Synk收购Invariantlabs-AI安全技术的强强联手
2025年6月24日,安全AI软件开发领导者Snyk宣布收购AI安全研究公司Invariant Labs。Snyk CEO称收购增强了抵御新兴威胁能力。Invariant Labs在MCP领域领先,成果丰富,Snyk也有多样产品,合并有望带来1+1>2效果。
微软开源了一款 skill 神器,这下爽了!
近期微软开源桌面应用 `Skill Recorder`,1个多月揽3K star。它能录屏幕操作,借助 GitHub Copilot CLI 生成可复用 Skill 或 Automation,与 RPA 思路不同,有泛化能力,可按命令快速安装。
国产开源模型越多,模型路由的机会越大
中国大模型市场模型增多,能力相近、价格降低且部分开源。开发者选择多但企业选模型难,价值向调度层转移。开源改变产业结构,Routing业务有价值且至少含四层,中国Provider Routing易落地。