FBI 等部门警告:美数百用户已遭“美杜莎”勒索软件攻击,威胁范围正在扩大三大运营商回应新华社有关“通信电话营销”报道:已开展自查2025 年 315 晚会结束,盘一盘未曝光的购机 / 租机陷阱京东超市:自营商品若出现质量不符合国标的卫生巾 / 纸尿裤,予以百倍赔偿重庆高院公布 315 权益保护典例:情侣住民宿被偷拍,经营者赔偿土巴兔回应“涉嫌购买 315 晚会曝光‘精准获客软件’”,称“有过商务洽谈,最终未达成实质性合作”中国移动回应 2025 年 315 晚会“通信电话营销”报道,称已“第一时间开展针对性自查”啄木鸟发布整改承诺书,将推进全面核查投诉订单、价格透明化改革等六大措施浙江诸暨通报“直播间售卖假珍珠”:一商户涉嫌刑责已移送警方侦查广西成立联合工作组调查“非标电线电缆”涉事企业越南政府呼吁科技巨头加大对越投资力度:保证发展更快、更强、更高效优音通信回应被 3・15 晚会点名:将积极配合相关部门调查与工作指导截至 3 月 14 日,全国收到 2025 年汽车以旧换新补贴申请约 130 万份央视起底黑公关:一篇漫画被水军刷屏攻击手机品牌315 晚会曝光后,广东督促“保水虾仁”涉事企业召回相关产品与辉同行:第一时间下架全部虾仁相关商品,对购买“大岸浪花品牌”冷冻虾仁消费者先行退一赔三2025 央视 315 晚会率先曝光“翻新卫生巾”,多家知名母婴品牌残次料竟被翻新售卖市场监管总局:全面加大包括直播带货在内的网售产品抽查力度优惠券套路深,2025 年 315 晚会曝光网络虚假“手机抽奖”案例缺斤短两损安全,2025 年 315 晚会曝光五金市场公开售卖的非标电线电缆
  • 首页 > 云计算频道 > 大模型

    支持中文,性能超GPT-4!笑脸排名第一的纯代码模型

    2023年11月30日 16:53:37   来源:AIGC开放社区公众号

      本文来自于微信公众号 AIGC开放社区(ID:AIGCOPEN),作者:AIGC开放社区。

      生成式AI代码开发平台Phind在官网发布了最新V7版本,性能方面超越GPT-4,运行效率提升了5倍,并且支持中文和16K超长上下文。

      据悉,Phind V7是基于Phind的开源代码模型CodeLlama-34B V2,以及700亿个高质量代码和推理问题进行了额外精调。

      CodeLlama-34B V2在huggingface(笑脸)的代码大模型排行榜中位居第一名,这也是首个击败GPT-4的开源代码项目。

      Phind V7专业代码开发平台

      Phind V7在HumanEval上的测试分数达到74.7%,成功超越了GPT-4在今年3月份的官方技术报告中公布的67%的成绩。

      但Phind发现,HumanEval的评分并不能准确地反映出大模型的实用性。

      Phind将多个版本部署到自家服务平台后,收集到了大量反馈信息,发现其模型在大多数真实问题上的表现与GPT-4相当甚至更好。

      许多在其Discord社区的用户已经开始只使用Phind的产品,尽管他们也订阅了GPT-4。

      除了性能超强之外,运行速度是Phind V7的一大技术亮点,通过在NVIDIA的新型TensorRT-LLM库上运行模型,Phind成功实现了比GPT-4快5倍的运行速度,达到每秒处理100tokens。

      另一个优点是Phind支持多达16k tokens的上下文。目前,Phind允许用户输入最多12k tokens,剩余的4k tokens用于网络结果。

      Phind V7精通Python、C/C++、TypeScript、Java等主流编程语言,使用界面也简单直观,直接输入你的编程问题就能返回代码。

      例如,我们直接输入中文提示:用python写一个吃豆游戏的代码。

      Phind返回的注释也都是中文,如果点击三角按钮可以直接在replit中运行非常方便。

      支持多轮深度对话,继续发问,游戏中的吃豆人和豆子是如何运动的?

      Phind在对文本回答时,会标注引用的原出处,用户点击网站可以直接跳转。

      CodeLlama-34B V2

      CodeLlama-34B V2代码模型使用了80,000个高质量编程问题和解决方案的专有数据集进行微调。这个数据集的技术特点在于,采用的是指令-答案对的格式,而非常见的代码补全示例,使得在结构上与HumanEval有明显的区别。

      此外,Phind还将 OpenAI 的去污方法应用在数据集中,以确保结果准确有效并且没有发现受污染的示例。

      方法是:1)对于每个评估示例,随机抽取了三个50个字符的子字符串,如果少于50个字符,则使用整个示例。

      2)如果任何采样的子字符串是已处理的训练示例的子字符串,则识别为匹配。

      在训练过程中,Phind使用了DeepSpeed ZeRO3和Flash Attention2技术,并使用了32个A100-80GB的GPU,仅在三小时内就完成了序列长度为4096的模型训练。

      经常编程的小伙伴们可以试试该模型,生成、审核、注释、改错样样精通,是降本增效的利器。

      文章内容仅供阅读,不构成投资建议,请谨慎对待。投资者据此操作,风险自担。

    即时

    新闻

    明火炊具市场:三季度健康属性贯穿全类目

    奥维云网(AVC)推总数据显示,2024年1-9月明火炊具线上零售额94.2亿元,同比增加3.1%,其中抖音渠道表现优异,同比有14%的涨幅,传统电商略有下滑,同比降低2.3%。

    企业IT

    重庆创新公积金应用,“区块链+政务服务”显成效

    “以前都要去窗口办,一套流程下来都要半个月了,现在方便多了!”打开“重庆公积金”微信小程序,按照提示流程提交相关材料,仅几秒钟,重庆市民曾某的账户就打进了21600元。

    3C消费

    华硕ProArt创艺27 Pro PA279CRV显示器,高能实力,创

    华硕ProArt创艺27 Pro PA279CRV显示器,凭借其优秀的性能配置和精准的色彩呈现能力,为您的创作工作带来实质性的帮助,双十一期间低至2799元,性价比很高,简直是创作者们的首选。

    研究

    中国信通院罗松:深度解读《工业互联网标识解析体系

    9月14日,2024全球工业互联网大会——工业互联网标识解析专题论坛在沈阳成功举办。