「多语言能力」共找到 6954 篇相关文章
对谈黄灯:普通二本学生的出路在哪里?
高考季,与《我的二本学生》作者黄灯对谈二本学生出路。指出学历非唯一,能力和热情更重要。当下就业严峻,高校课程与社会需求脱节,二本学生应提升动手能力,利用AI工具,立足学校和当地找机会。
普林斯顿团队领衔发布最强开源数学定理证明模型:32B性能大幅超越前代SOTA DeepSeek 671B
近日,普林斯顿大学牵头多机构推出开源数学定理证明模型 Goedel-Prover-V2。其 32B 旗舰模型在多基准测试超 DeepSeek-Prover-V2-671B,8B 小模型特定基准性能与之持平。该模型有三项关键创新,团队已公开模型及数据集。
企业微信给AI写了94份说明书,Claude Code现在能直接干活
北京时间8月17日,企业微信更新,将能力域从7个扩到12个,参考文档扩到94份。介绍了其能操作的业务品类,分析文档权重体现的产品意图,阐述三个设计细节,指出想象空间、机会及坑,强调此次更新比首次更重要。
AI哪怕答案正确,逻辑链却惨不忍睹,奥数级不等式证明成功率不到50%| 斯坦福&伯克利&MIT
斯坦福、伯克利、MIT等联合研究,系统评估29个大模型在奥数级不等式证明任务的能力。研究发现,模型答案正确多靠猜,推理漏洞多,参数大、思考久也不能提升推理严谨度,但自我反思和定理线索策略有改善效果。
A16Z发布最新AI应用榜单,中国产品强势崛起
a16z发布第五期消费级AI应用排行榜,此榜单已成观察AI日常使用趋势的重要指标。新面孔减少,生态趋于稳定。Google发力,多个产品入榜;Grok表现佳,Meta AI欠佳;中国产品崛起,多个上榜;‘Vibe Coding’平台带动其他工具增长。
缔造OpenAI的秘密,竟只有一个词!新智元十年峰会圆桌,七位大咖激辩
新智元十周年圆桌论坛上,七位嘉宾探讨通往AGI与ASI的关键问题,如智能核心、AI能效、游戏与AI关系等。他们认为AI发展超预期,语言是智能核心,实现ASI关键在能耗,还谈及芯片与人脑差距、物理世界发展慢等话题。
昨晚,OpenClaw大更新,亲手终结「旧插件」时代
昨晚OpenClaw重大版本更新,内容多到需单独做目录梳理。重点在ClawHub插件市场、多模型支持等。最重要变化是插件生态重心转向,且体系大改、工具能力收敛,还在多方面有更新,创始人指出正式版有功能加载问题。
才知道百度和阿里为什么能联手瓜分市场了
AI热度未减但问题转变,企业更关注全栈能力。沙利文报告显示2025年上半年阿里云和百度智能云占一站式AI云市场超一半。阿里和百度长期投入,全栈能力让其在竞争中更笃定,苹果也选它们为中国AI伙伴。
硅谷祛眼袋,海淀求嫩肤:中外科技老哥都在偷偷卷颜值
加州整形外科医生爆料,过去五年科技圈男性做医美的多了五倍,对拉皮等开刀项目也趋之若鹜。国内科技大厂周边医美机构男性客户也增多,多以轻医美为主。科技从业者医美需求飙升,与年龄焦虑和找对象需求有关。
大语言模型逻辑评估
现有归因问答评估方法有‘归因短视’问题,研究团队提出 LOGICSCORE 框架,从三维度量化推理质量。在多数据集测试多款 LLM,发现专有、开源模型等存在不同逻辑问题,还分析典型逻辑错误。