🔥热榜:2024-12-05

蓝佛安:加快落实一揽子隐性债务化解政策。

《时事报告》杂志刊登财政部部长蓝佛安署名文章:《加快落实一揽子隐性债务化解政策》。文章指出,财政部将切实提高政治站位,密切配合地方,会同有关部门强化政策协同,形成工作合力,推动化债政策落地见效,把党中央出台的隐性债务化解政策好事办好。

一是加快债券发行使用,尽早发挥政策和资金效益。目前,财政部已将新增6万亿元债务额度下达各地。我们将指导各地合理分配债券资金,抓紧细化置换债券发行和使用计划,明确“时间表”和“路线图”,加快发行使用进度,确保再融资债券“发行一批、置换一批”,让政策效应尽快释放。同时,强化全流程全链条监管,确保每一笔资金依法合规使用。

二是坚决遏制新增隐性债务,完善地方政府债务管理。健全部门信息共享和监管协同机制,全口径监测地方政府债务情况,对新增隐性债务保持“零容忍”的高压监管态势,将不新增隐性债务作为“铁的纪律”,持续加强预算管理,督促地方依法合规建设政府投资项目。不断完善地方政府债务管理,加快建立同高质量发展相适应的中国特色债务体系。

三是推动融资平台加快改革转型,坚决防止违规为地方政府提供新增融资服务。结合存量隐性债务置换和地方债务风险化解工作进展,加快推进融资平台改革转型,持续压减融资平台数量。目前,化解融资平台债务风险工作已取得重要阶段性进展,融资平台债务风险水平显著下降。下一步,财政部将加强与金融管理部门配合,持续推动地方做好融资平台债务风险化解工作。
牧原股份:11月生猪销售收入120.68亿元。

牧原股份公告,2024年11月份,公司销售生猪638.3万头,其中商品猪590.6万头,仔猪45.9万头,种猪1.8万头,销售收入120.68亿元。向全资子公司牧原肉食品有限公司及其子公司合计销售生猪133.5万头。商品猪销售均价为16.22元/公斤,比2024年10月份下降5.53%。
代码大模型越来越卷,评估AI编程水平的“考卷”也被迫升级。12月5日,字节豆包大模型团队开源最新代码大模型评估基准FullStack Bench,在业界首次囊括编程全栈技术中超11类真实场景,覆盖16种编程语言,包含3374个问题,相比此前基准,可以更有效地评估大模型在现实世界中的代码开发能力。 代码评估基准是衡量大模型编程能力的标准工具,也是推动模型优化的关键驱动力。不过,当前的代码评估基准覆盖的应用类型和编程语言较为有限,难以反映真实世界中代码开发场景的多样性和复杂性。 比如,主流代码评测集HumanEval和MBPP中近80%数据只聚焦基础编程和高级编程问题;DS-1000中95%数据都集中于数据分析和机器学习任务,且仅对Python语言进行评测;xCodeEval虽覆盖多项任务,但基本局限于高级编程和数学领域。 ▲FullStack Bench数据覆盖超11种应用领域,远超当前主流代码评估基准 因此,字节豆包大模型团队与M-A-P开源社区联合提出FullStack Bench,一个专注于全栈编程和多语言编程的代码评估数据集。为囊括在真实全栈开发中涉及的各类应用场景,研究团队从全球最大的程序员技术问答社区Stack Overflow中随机抽取了50万个问题进行分析,筛选出占总问题数前88.1%的应用领域,并对其分布做了适当调整来保证每个领域的鲁棒性,最终形成了FullStack Bench关注的超过11种应用场景及分布比例。 FullStack Bench包含3374个问题,每个问题均包括题目描述、参考解决方案及单元测试用例,总计15168个单元测试。为保证评估准确性,问题内容均由相关领域的编程专家设计,并经AI和人工验证进行质量复核。在初始数据集构建后,团队根据主流代码大模型测试结果,按问题难度、模糊性和可解性对数据质量进行了交叉评估和进一步完善。 ▲FullStack Bench数据集构成情况 为方便开发者对大模型代码能力进行系统性测试,豆包大模型团队还开源了一款高效的代码沙盒执行工具——SandboxFusion,用于评估来自不同语言的不同编程任务。除了FullStack Bench,SandboxFusion还兼容超过10种广泛使用的代码评估数据集,支持23种编程语言。开发者在单服务器上即可轻松部署SandboxFusion,也可直接在GitHub上进行体验。 发布评测基准及沙盒的同时,字节代码大模型也首次曝光。研究中,豆包大模型团队对全球20余款代码大模型及语言大模型的编程表现进行了评测(详见论文),其中包括未披露过的豆包代码大模型Doubao-Coder。 近半年,字节在代码大模型领域进展迅速,今年6月字节发布了由自研代码基座模型支撑的AI编程助手豆包MarsCode,目前每月为用户贡献百万量级代码。 论文地址:https://arxiv.org/pdf/2412.00535v2 数据集开源地址:https://huggingface.co/datasets/ByteDance/FullStackBench 沙盒开源地址:https://github.com/bytedance/SandboxFusion 沙盒体验入口:https://bytedance.github.io/SandboxFusion/playground/datasets
19:01  人人都是产品经理  爆火的“谷子经济”是什么?一文读懂
自从B站破圈,米哈游的游戏爆火,原本圈地自萌的二次元领域也越来越被更多人熟知,对应的商业也越来越多——谷子经济,就是其中之一。这篇文章,作者对谷子经济进行了简单梳理,希望可以帮到大家。
谷歌推出全新 AI 气象模型 GenCast,能够提前 15 天提供更快速、更精准的天气预报,其预测准确度超越了欧洲中期天气预报中心(ECMWF)的 ENS 系统。
19:01  博客园  『玩转Streamlit』--表单Form
19:02  微博  李行亮被活动除名
19:02  微博  迪奥点灯活动
19:02  微博  Gemini长沙首播