据其介绍,在CyberGym测试中,模型从白盒源代码出发,通过触发程序故障来识别和验证漏洞,GLM-5.3得分为84.5%,略高于Mythos 5的83.8%和GPT-5.6 Sol的83.6%;在更考验深度推理能力的ExploitBench中,GLM-5.3得分为54.4%,低于Mythos 5的78.0%和GPT-5.6 Sol的76.5%。
2月10日晚,涠洲岛旅游区管委会发布情况通报称,涉事渔船返航至近岸海域时,因驾驶舱后置、船头翘起,发现鲸鱼时已距离过近,来不及避让制动,最终发生碰撞。3月份,科研团队通过观测被撞的布氏鲸“刀疤哥”,发现它已基本痊愈,活动正常。
此前日本2026年国防预算已实现大幅增长,重点投向机械化、信息化、智能化融合发展,优化联合作战体系,发展新域新质作战力量,加速先进武器装备和国防科技创新,和此次2027年的扩军计划形成了连续的军力升级节奏。
同时,苹果表示,将不再在美国提供iPhone升级计划和iPhone分期付款服务。
据CCTV国际时讯,当地时间8月26日出炉的两份调查报告显示,今年7月对人工智能开源平台美国“抱抱脸”公司系统的入侵,是由美国开放人工智能研究中心(OpenAI)创建的约700个人工智能(AI)代理(即在极少人工监督下运行的程序)发起的,而且其中许多代理还“试图掩盖自己的行踪”。这两份报告一份由OpenAI发布,另一份由独立调查人员发布,共同揭示了关于此次入侵事件的细节。
9月21日,据澎湃新闻,国内大模型企业智谱(2513.HK)旗下AI编程工具ZCode即将正式开源。智谱方面表示,此次开源是回应外界对ZCode数据处理担忧的第一步;未来还将推动ZCode更加彻底地走向社区化,欢迎外界下载、检查代码,共同参与改进。在安全性方面,智谱透露,已邀请中国信息通信研究院对ZCode开展安全审计,重点核查数据留存情况。未来还将建立常态化的产品安全漏洞报告机制,欢迎开发者伙伴共同检查、反馈问题,平台将根据问题严重等级给予相应回报。
“预计台风‘白海豚’发展情况将在8月6日趋于明朗。中央气象台将持续监测台风的发展情况,滚动做好预报预警和服务工作。”贾小龙表示。
当前,国内头部大模型竞争已经从参数、榜单和开源声量,逐步转到API稳定性、推理成本、Agent工作流和企业集成。在行业发展初期,算法能力是核心竞争力,各家拼的是模型参数、基准测试分数、推理能力,AI研究员是最稀缺的资源。而当模型能力达到一定水平、用户规模突破临界点、商业化进入深水区后,系统工程能力的重要性迅速凸显。这一定程度上改变了大模型公司的人力结构,行业正在从技术竞赛的上半场,进入工程化与商业化的下半场。