Linux.do热榜 · 2026-08-02 历史榜单

当日热门内容存档(共 30 条)

这是 2026-08-02Linux.do热榜历史存档。查看 实时Linux.do热榜 获取最新排名。

  1. 1
    说个恐怖故事:服务器G口已经不够用了

    比较敏感一些的佬友应该发现了,最近有时候访问社区帖子会出现偶尔的卡顿,再点又不卡。看服务器 load 也不是那么高,根本没往网络这块想,原来 1G 的带宽已经不够用了。 之前的截图没保存,我们随手截个sar图来看一看: 第二个口是 1G 网口,第五个口是我们升级新装的 10G 网口,大家可以算一下,其实已经超过 1G 带宽,不升级要丢包的。 昨天已经动用钞能力给社区所有服务器升级了 10G 网口,今天大家应该能感觉到访问流畅。至于为什么 1G 口还在用,是因为有些服务不想停机切换,有空再弄吧。 这当然构不成公告,我们想说的是:经过软硬件升级和评估,我们终于能再度开放实时私聊功能,佬友们可以点击头像旁边的对话按钮进行体验了。 不过多占用各位时间,接着奏乐接着舞~ 559 个帖子 - 548 位参与者 阅读完整话题

  2. 2
    喜迎 DS-v4-Flash 紧急扩容

    太猛了,DeepSeek一发版本,在某个无人在意的角落,就有一个无名的社区要炸。 但这是好事,喜迎新国模,国模崛起是人心所向,需要大家多多支持。至于我们,没关系,直接加机器就行了。 社区已再度紧急扩容,接着奏乐接着舞~ 新模型出来了,都去支持一下啊,该测试的测试,该写代码的写代码,水什么社区呢 290 个帖子 - 286 位参与者 阅读完整话题

  3. 3
    (没有了)「君の公益」 周末福利,微微活一下

    结束,暂时不考虑免费供应 蹬吧,蹬完为止 所谓有求而不得,人心欲壑,可填沧海~ 302 个帖子 - 244 位参与者 阅读完整话题

  4. 4
    猫猫道歉帖子[新主贴]

    本帖使用社区公益推广,符合推广要求。我申明并遵循社区要求的以下内容: 我的项目是免费使用的,无收费(变相收费、赞助)部分: 是 我的帖子已经打上 公益推广 标签: 是 我的项目属于个人项目,与公司或商业机构无关: 是 我的项目不存在QQ、TG等群组引流: 是 我的项目不存在非运营必要的网站引流: 是 我的项目不存在为他人推广、AFF: 是 我的项目无关联的商业项目: 是 我的站点存在登录,并已接入 LINUX DO Connect: 是 我帖子内的项目介绍,AI生成、润色内容部分已截图发出: 是 以上选择我承诺是永久有效的,接受社区和佬友监督: 是 以下为项目介绍正文内容,AI生成、润色内容已使用截图方式发出 首先跟各位佬说个对不起,搞东西搬迁的时候把mysql删掉了 搞好了之后会免费一段时间,新站注册每人2000刀签到500再送要亏本了 api.maoyulin.xyz New API 统一的 AI 模型聚合与分发网关,支持将各类大语言模型跨格式转换为 OpenAI、Claude、Gemini 兼容接口,为个人与企业提供集中式模型管理与网关服务。 LD士多 页面未找到 - LD士多 在 LD士多 使用 Linux.do 社区积分兑换精选虚拟物品与服务。 202 个帖子 - 192 位参与者 阅读完整话题

  5. 5
    【已拉闸】claude狂欢,随便开x20MAX!!!,详细教程!!!

    已经成功! 第一步,选一个日本节点 第二步,随便搞一个邮箱,推荐 proton.me claude权重高,不用手机号。 直接用这个邮箱登录,进入注册流程 收到邮箱直接点击链接打开 直接创 直接max 直接x20 国家德国 选SEPA 用这个随机生成一个 http://randomiban.com/ 填这里 其他随便填 MAX到手!! 导入sub2api!没用我的:【picpi 皮皮工艺站】共享sub2api开放注册!低成本维护自己的号池! 下一步 完成开蹬!!!! 444 个帖子 - 328 位参与者 阅读完整话题

  6. 6
    今天是我20岁生日,佬友们可以祝我生日快乐嘛

    来L站的第一个生日喵! 感觉时间过得好快鸭,一转眼已经20岁了喵ww 有小蛋糕哩,今天我要放纵一整天喵! 麦当当还是太远哩,好懒好懒~不想出门喵w 356 个帖子 - 355 位参与者 阅读完整话题

  7. 7
    刷脸不是长久之计,所以君の公益昨天我给停了

    从想问一下开公益站的佬友们是什么心态,造福这么多佬友,全是自费办公益吗继续讨论: 这是我的一个朋友,之前经常互相免费接k12的池子做公益,他也有付费站,这段时间k12活不下去,我一直接的他的池子,哈哈,刷了他好几千块,不过是刷脸 后来想想算了,一直白嫖人家的池子做公益也不太好,有点慨他人以慷,我就把渠道停了,刷脸不是长久之计,所以君の公益昨天我给停了 我们都这么熟了 公益站都给你跑几千块了都 还差你这几百 180 个帖子 - 172 位参与者 阅读完整话题

  8. 8
    泪目,Cloudflare 大善人终于搞域名优惠了?

    坦白说比较少见 cf 搞域名优惠活动,这玩意有个数限制吗,有没有懂的佬友? 续费价格: 110 个帖子 - 105 位参与者 阅读完整话题

  9. 9
    博诸君一笑,我绷不住了

    处置方式 152 个帖子 - 128 位参与者 阅读完整话题

  10. 10
    【小始皇】平凡的一天,可以祝我生日快乐吗

    一年,生活里没有太多朋友相伴,但很多开心和温暖,都留在了 L 站里。感谢一路陪伴的佬友们,让平凡的日子也多了一些欢笑和回忆。 时间总是让人猝不及防,不知不觉间,又长大了一岁。 回望过去,一路跌跌撞撞,有过迷茫,也有过失落,但那些经历都成为了成长的一部分。过去已去,未来已来。 愿自己与时光握手,与岁月言和。愿新的一岁,依旧保持热爱,慢慢前行,遇见更好的自己。 也祝陪伴我的佬友们,生活顺遂,万事如意。 生日快乐,祝我自己。 167 个帖子 - 162 位参与者 阅读完整话题

  11. 11
    【小鸡毛】不要再问为什么小鸡毛GPT用不了了,已经泥菩萨过江自身难保了

    渠道基本上拉闸的差不多了,还有一小部分渠道和技术掌握在一小部分人手中 号池几百个PLUS,也不知道是破限弄死的,还是奥特曼杀死的 5月份至今的战绩: 维护渠道花掉的钱: 6570亿token,564956刀 76 个帖子 - 73 位参与者 阅读完整话题

  12. 12
    论社区的举报文化

    如题所示,不知道社区到底是从什么时候开始的如此一股严重的举报文化,求推荐模型会被举报可能引来广告,吐槽一下阿里新出的模型会被举报,从v2到ns再到52pj,从未见过举报文化如此盛行的社区,社区的建立和维护本来就是社区成员相互信任构成的。甚至是连讨论举报这件事情都会被举报。 我在此请求各位摸着良心说,你能看到这个帖子,你没有违反中华人民共和国法律吗?你希望下午就被人举报使用vpn吗?你希望你摸鱼的第二天就被人举报到老板吗? 我认为当前的举报成风的社区,没有任何人可以对或者应该对任何社区成员抱有任何的信任。尤其是在举报还有奖励的情况之下,所谓的次数限制无非是一个明面上的所谓的限制,对社区成员的信任毫无帮助,对社区的帮助更无帮助。社区的进步从来不是靠成员之间相互举报促进的。 215 个帖子 - 134 位参与者 阅读完整话题

  13. 13
    『富可敌国』『高级推广』君の星辰 codex 降至0.066

    君の星辰 codex 降至0.066 欢迎大家体验 (禁止nsfw和涉政) 具体使用体验会跟随号池状态,openai官方状态,网络状态等因素波动,请大家理性消费。 实际价格会跟随成本波动,实际价格以官网为准,帖子价格可能滞后 首字直接起飞~ 君の星辰官网:https://ai.centos.hk 官方 Telegram 群: Telegram: View @XingChen_AI 官方 Telegram 频道: Telegram: View @XingChenaiTG 164 个帖子 - 133 位参与者 阅读完整话题

  14. 14
    [富可敌国]AIHUB我们来送Mac mini啦~对于站点的一些更新和计划借着这个机会跟大家说一说!

    入驻 L 站以来,AIHub 用户突破 10,000! 从 7 月 14 日入驻 L 站以来,我们陆续取得了几个小成绩: 用户数突破 10,000 Rate 商家评价排名 第一 QQ 群人数突破 2,000 大家的热情,我们都收到了! 这段时间里,我们也听到了许多不同的声音:有人认真反馈问题,有人直夸牛逼,也有人认为我们的服务还不够稳定。 这些评价和建议,我们全部接受。大家反馈的每一个问题,我们都在持续跟进和改进。 关于价格与盈利 很多大佬都在问: 你们的价格这么低,到底怎么盈利?又是怎么送出这么多 10 美元余额的? 截至目前,我们大约亏损了 5 万元;如果算上本次抽奖的 Mac mini,总投入大约是 5.5 万元。 这不是卖惨,只是想把实际情况告诉大家。 我们非常害怕用户充了钱使用了超低倍率体验感不好 用多少充多少!我们目前没有做充送的打算是不想把用户强行捆绑在我们这里,一定有很多比我们做的更好服务更好的站 我们的理念一直很简单:先把量做大。 目前,我们定下了每天 1,000 B 的目标。我们不希望依靠高倍率赚钱,而是希望通过规模获得更大的议价空间。 只有量足够大,我们才能更好地与上游谈价格: C 端用户可以获得更低的使用价格; B 端用户可以拿到更有竞争力的合作价格; 平台也能获得更稳定、更长期的发展空间。 如果只是作为普通中转,以相对较高的价格出售,确实会有一部分用户接受,但这个群体终究有限。 我们想做的是一个价格能被更多人接受的平台。 欢迎加入 QQ 群 非常建议大家加入我们的 QQ 群。 群里的气氛非常活跃,有三位群友客服(发工资的XD,也聚集了许多技术大佬。在我们还没有推出故障转移功能时,群友们就已经开发出了多个本地自动路由、最优分组播报等实用工具。 我们也会不定期在群内开放 0.01 倍率活动。 关于近期攻击 从上线以来,我们一直遭遇来自各方的针对、敲诈和 DDoS 攻击,甚至有人花费 1,000 USDT 攻击我们的服务。 相关截图这里就不放了,是真的惨。 前天,我们已经将服务器升级为 OVH 美西 9965 服务器: 首月费用:1,862 美元 后续费用:931 美元/月 希望这次升级能够为大家带来更加稳定的使用体验。 或许这篇帖子发布后,新一轮攻击很快就会到来。对于这种情况,我们会对抗到底。 如果访问时暂时出现错误,请不要担心,也请给我们一点处理时间。 近期更新 下面简单介绍一下我们最近完成的功能更新,可能仍有不足,欢迎大家继续反馈。 API 密钥故障转移 API 密钥最高倍率限制 API 密钥倍率变更邮件通知 故障转移日志 自助发票 首页教程 故障转移策略 系统目前支持以下 3 种故障转移策略: 最低倍率优先 最低首字延迟优先 候选分组优先 故障回切策略 系统目前支持以下 3 种回切方式: 自然回切 积极回切 不回切 故障转移条件 系统会综合以下数据判断是否执行故障转移: 原分组的真实使用记录样本; 供应商大厅的探测数据; 同时满足以上条件后,由用户发起主动探测并完成最终确认。 目前,服务端故障转移功能已经具备较为完善的策略和探测机制,欢迎大家体验。 如果在使用过程中遇到问题,请及时反馈,我们会持续跟进并修复。 此外,群友 @seclong 开发的自动路由项目也非常实用。感兴趣的用户可以前往 AIHubRouter 项 了解和使用。 Mac mini 抽奖 最后的最后: 真诚永远是必杀技!Passion!!! 开奖时间: Mon, Aug 3, 2026 12:00 AM CST 奖品内容: 最新款 Mac mini 基础版,Apple 官方售价 ¥5,999 兑奖要求: 出示开奖前注册的 AIHub 账号 注册福利: L 站用户注册后即时到账 10 美元余额(如其他邮箱注册可联系客服领取 联系我们 QQ 群: 1059338666 Telegram 群: https://t.me/+02N48HsDdd44YTY1 商务合作: @gege33266 欢迎各大小中转、源头渠道及 B 端客户洽谈接入合作。商务合作请直接联系商务账号,请勿添加用户群。 1567 个帖子 - 1567 位参与者 阅读完整话题

  15. 15
    【蓝色大肥鱼竟敢吃白饭】

    ds v4没发布时:金融吸血鬼的谎言泡沫即将破裂 v4 预览版发布时:deepseek的新一代大模型发布,但代价是什么? v4 预览版承认由于gpu产能导致现在自己价格虚高时:一颗新星正在冉冉升起 v4 预览版打二五折时:开源界的英雄正在拯救闭源的黑暗ai界 v4预览版宣布命中缓存输入打1折时:德技双馨的老企业家梁文峰再攀高峰 v4预览版宣布25折永久保留时:伟大的梁圣和他的大赢鲸莅临ai界 v4 正式版迟迟不出时:爱梁,信梁,等梁 v4宣布涨价:蓝色大肥鱼竟敢吃白饭, v4正式版跳票:小难梁掏不出大赢鲸 ds官方未就跳票做出解释:大wait die梁子重新定义七月中旬,ds的神话还能持续多久? gpt luna降价:新一代斩杀线正清算被背信弃义的伪朝 v4 flash 0731发布:亿万鲸子清算!对所有AI企业后门进行深度求索! 38 个帖子 - 38 位参与者 阅读完整话题

  16. 16
    【CHY公益站】 一觉醒来,成功飞升

    公益推广 (点击了解更多详细信息) 今天一觉醒来,本来是要去 福利羊毛 区,找找有没有新渠道,结果发现我居然能查看三级的帖子 当前可用模型: 话说佬友们谁知道三级的 L 站 专属邮箱在哪获取吗 对了,还有一个好消息,我发现标签里面居然有 CHY公益站 以后帖子就发在这个标签里面了 122 个帖子 - 97 位参与者 阅读完整话题

  17. 17
    giffgaff明确表示拒绝退款后,我已正式向Ombudsman提起申诉

    从这篇帖子来 giffgaff被封后续退款申请 - 搞七捻三 / 搞七捻三, Lv1 - LINUX DO 今天早上一起床也是收到了giffgaff正式申诉被拒绝退款的最终通知: (点击了解更多详细信息) 结合这篇帖子:刷到个投诉 giffgaff 的方式(转载) Ofcom在英国类似工信部 从昨天开始截止到今天,据不完全统计,giffgaff的工单号已经累计过万,大部分佬友都被拒绝退款或冷处理,实在看不惯这种强盗行为,所以我通过Communications Ombudsman对giffgaff提起了申诉,以下是让gpt帮我总结的投诉流程和部分截图,希望能给各位佬友提供参考: (点击了解更多详细信息) 投诉完成后收到的邮件和待处理状态截图 (点击了解更多详细信息) 目前ombudsman还未分配专员跟进,我跟giffgaff正在持续对线中,把往来邮件同步到了ombudsman的 Evidence 中 (点击了解更多详细信息) 截至7月30日21:35最新进度 (点击了解更多详细信息) 所以指望giffgaff主动退钱应该没戏了。现在有以下三条路: [update已收到退款]GG卡招行信用卡回复 giffgaff被封号,官方不回复,招行秒退款 公益捐助(没有办法的办法) 此贴实时更新进度,并整合gg相关的帖子供各位佬友参考,让子弹再飞一会吧 155 个帖子 - 112 位参与者 阅读完整话题

  18. 18
    Cloudflare 优选加速保姆级图文教程

    Cloudflare 优选域名加速保姆级教程 之前也发过一篇类似的文章,由于Cloudflare的界面大改,也没有图文教程。所以Cloudflare 优选域名加速保姆级教程 诞生! (点击了解更多详细信息) 二、开工前先备好这些东西 一个域名,NS 必须完全转到 Cloudflare 名下(如图)。免费域名(比如 dpdns.org,eu.cc等)也能用,但千万别用"双向免费"那种域名,容易被 CF 判定滥用直接给你限制了 一个优选域名,本文用 cdn.091224.xyz 当例子,你也可以换成自己找的其他优选域名 看你的需要,可能还得注册个第三方 DNS(比如华为云国际版)或者SaaS要绑个支付方式(PayPal、信用卡都行) 准备好了咱就分三种情况来讲:Worker、Pages、Cloudflare for SaaS。你项目部署在哪(哪里需要优化)就看对应那一节,不必浪费时间。 三、方案一:Worker 怎么弄 适合你的项目跑在 Worker 上的情况,比如 API 网关、边缘函数这类。 核心思路:用"路由"(Route)绑定域名,别用 Worker 自带的"自定义域名"功能。为啥?因为路由能让你自己控制 DNS 代理开不开,这正是优选的关键——把 DNS 记录改成"仅 DNS"(灰云朵),流量先走优选域名解析,再交给 Worker 路由接管。 具体咋操作,拿 img.yourdomain.com 举例: 打开 Cloudflare 仪表盘,选你的域名 → DNS 管理页面 加一条新记录: 类型:CNAME 名称:随便起,比如 img 目标:cdn.091224.xyz(或者你自己的优选域名) 代理状态:一定要点成灰色云朵,千万别开橙色代理 去 Workers & Pages → 找到你的 Worker 项目 → Settings → Domains & Routes 加路由: 规则填 img.yourdomain.com/* Zone 选对应域名 保存,等 DNS 生效。一般 1 到 5 分钟,很多时候不到一分钟就好了 注意:千万别用"Custom Domains"那个选项,那个会强制走 Cloudflare 自己的代理,优选根本不生效。必须用路由,而且规则最后一定要带 /*,不带的话只有主路径能访问,子路径全 404。 四、方案二:Pages 怎么弄 适合静态站点或前端项目部署在 Pages 上的情况。 为啥麻烦一点:Pages 绑定域名的机制跟 Worker 不一样,不让你自由控制代理开关,所以不能继续用 CF 自己的 DNS 做分流,得靠第三方 DNS(这里用华为云国际版)的"分线路解析"能力,专门给大陆用户返回优选域名的记录。 准备:CF 托管的域名 + 优选域名,再加一个华为云国际版https://console-intl.huaweicloud.com/dns/?region=ap-southeast-1#/dns/dashboard账号(注册时建议开着全局代理,要不然可能会被重定向至国内站)。 拿 img.yourdomain.com 走一遍: 进 Pages 项目 → Custom domains → 添加 img.yourdomain.com 系统会给你一条 CNAME 记录,记下来(长得像 zsfan.pages.dev 这样) 登录华为云国际版 → DNS 服务 → 公网域名 → 创建公网域名,填完整的 img.yourdomain.com 创建成功后进解析管理(注意要在Cloudflare添加相应的NS记录,要不然不会生效),加两条 CNAME(除了自己的配置,其余的与图片保持一致即可): 第一条:线路选"全网默认",值填 Pages 给你的 pages.dev 地址 第二条:线路选"地域解析 > 中国大陆",值填优选域名 cdn.091224.xyz 保存 注意:填域名时一定要跟 Pages 里绑的完全一致,别偷懒简化。华为云会给你 4 条 NS 记录, 记得回 Cloudflare 的 DNS 里把这 4 条也加上,不然解析不生效。 加完之后华为云可能还在提示你加 NS,不用管,忽略就行。 五、方案三:Cloudflare for SaaS 怎么弄 适合你有自己服务器(不在 CF Pages/Worker 上),又想主域名走 CF 保护,同时国内还能走优选线路的情况。这个是三个方案里最绕的,但也最灵活。 思路:用一个"回源域名"(必须托管在 CF)当跳板,通过 Custom Hostname 这个功能,让另一个完全独立、甚至没托管在 CF 的"主域名"也能享受 CF 的代理和证书,最后流量还是会转回你自己的服务器。叠加优选分流后:大陆用户走优选 IP 进来,CF 认出 Host 之后转发给你真实的服务器,你的服务器都不用托管在 CF。 准备:两个域名——主域名 a.com(用户实际访问的,不用托管在 CF)、回源域名 b.com(这个必须转 NS 到 CF);再准备一张信用卡或 PayPal(开 SaaS 功能强制要绑支付方式,推荐 PayPal,方便点);还有优选域名 cdn.091224.xyz。 第一步,先弄回源域名 b.com: 确认 b.com 的 NS 转到了 CF 加 A 记录指向你真实服务器 IP,这次一定要开橙色云朵代理(跟前两个方案正好反过来,这里就是要 CF 的代理层帮你处理证书和转发) SSL/TLS 加密模式改成"灵活"或"严格"(服务器自己有证书就选严格,没有就选灵活) 点击右上角的配置 根据图片指引配置 进 SSL/TLS → Custom Hostnames: 先加"回源主机名"(填 b.com 或者 saas.b.com), 再加"自定义主机名"(填 a.com,TLS 保持默认), 保存 第二步,验证域名: CF 会让你在 a.com 的解析商那边加一条 TXT 记录,用来验证域名归属和签证书 按照图示依次添加两条TXT记录 加完之后回 CF 的 Custom Hostnames 页面,点页面里的刷新按钮,别用浏览器刷新或 F5,那样不管用 一般几分钟就变成"Active"了,说明证书和映射都搞定了 第三步,配大陆分流: 在 a.com 的解析商那(还是用华为云举例)加个子域 cdn.a.com 设成中国大陆线路,CNAME 指向优选域名 cdn.091224.xyz 保存等生效 搞完这三步,效果就是:大陆用户访问 a.com 走优选 IP 进 CF,CF 认出来是 a.com 之后转发到 b.com 背后你的真实服务器,全程你服务器的真实 IP 都藏在 CF 后面,别人看不到。 到此结大功告成,欢迎分享,点赞 有什么不懂的可以滴我哈 49 个帖子 - 34 位参与者 阅读完整话题

  19. 19
    记一次对 DeepSeek V4 Flash 0731、GPT 5.6 Luna/Sol、Claude Opus 5、Grok 4.5、Kimi K3 的真实项目需求的横向评测(仅 284B 的 T1 模型!)

    由于测试的模型越积越多了,表格会删除一些同厂商的旧模型,你可以在之前的评测帖子里找到它们的成绩。 项目 这是一个 Unity C# 项目,我进行测试的是一份皮肤系统需求案,我已经做了好预制体,而模型需要编写代码。 本轮与上两轮评测的项目和环境都完全一致: 第一轮 … 上一轮 模型来源 Grok 4.5: Grok Build Kimi K3: 火山 Agent Plan Claude Opus 5: Claude Code 自行中转 GPT 5.6 Sol/Luna: Codex 自行中转 DeepSeek V4 Flash 0731: 官方 API 速度 排名 模型 时间(分钟) 备注 1 Composer 2.5 3 2 Grok 4.20 0309 Reasoning 3 3 Step-3.5-Flash 6 4 Mimo V2 Omni 7 5 Doubao-Seed-2.0-Lite 7 6 Doubao-Seed-2.0-Pro 9 7 Doubao-Seed-2.0-Code 9 8 Qwen3-Coder-Next 9 9 Claude Sonnet 4.6(high) 9 10 Qwen3.5-Plus 9 11 GLM-5 Turbo 10 12 Minimax M2.7 10 Highspeed 版本 13 Qwen3.5-Flash 10 14 Grok 4.3 10 15 Gemini 3 Pro 11 16 Grok 4.5 13 17 Hy3 Preview 13 18 GPT-5.5(low) 13 19 Grok Build 0.1 14 20 GPT-5.5(medium) 15 21 Mimo V2 Pro 15 22 DeepSeek V4 Flash 0731 17 23 DeepSeek V4 Flash 17 24 Qwen3.7-Plus 17 25 Qwen3.7-Max 18 26 GPT-5.5(high) 19 27 Claude-Opus-4.7(Max) 20 28 GLM-5 20 29 DeepSeek V4 Pro 21 30 Gemini 3 Flash 22 31 Claude-Fable-5(xhigh) 23 32 Mimo V2.5 24 33 KAT-Coder-Pro V2 24 34 Minimax M3 25 35 Claude-Opus-4.6(Max) 26 36 GPT-5.5(xhigh) 28 37 Gemini 3.1 Pro(high) 29 受 429 请求频率限制影响 38 Claude-Opus-4.8(Max) 33 39 Kimi K2.6 33 40 Qwen3.5 9B GGUF Q4_K_XL 35 MBP M4 Pro 48GB 本地部署 41 Qwen3.5 35B A3B GGUF Q4_K_XL 36 MBP M4 Pro 48GB 本地部署 42 GPT 5.6 Sol 36 43 Mimo V2.5 Pro 37 44 Kimi K2.7 Code 39 45 GLM-5.2 45 46 Claude Opus 5 55 47 Kimi K3 93 48 GPT 5.6 Luna 95 令牌数 Grok 4.5: 未知 Kimi K3: 15M(¥40) Claude Opus 5: 24M GPT 5.6 Sol: 未知 GPT 5.6 Luna: 47M DeepSeek V4 Flash 0731: 21M(¥0.94) 代码行数 Grok 4.5: +1924, -18 Kimi K3: +1903, -6 Claude Opus 5: +1943, -8 GPT 5.6 Sol: +1201, -8 GPT 5.6 Luna: +1223, -13 DeepSeek V4 Flash 0731: +2184, -133 完成度 Grok 4.5 审查结论: 完成度非常高,出现两个功能错误问题。 (点击了解更多详细信息) Kimi K3 审查结论: 完成度非常高,出现两个功能错误问题。 (点击了解更多详细信息) Claude Opus 5 审查结论: 完成度非常高,出现一个细节问题。 (点击了解更多详细信息) GPT 5.6 Sol 审查结论: 完成度极高,无明显问题。 (点击了解更多详细信息) GPT 5.6 Luna 审查结论: 完成度尚可,存在功能未实现及多个细节问题。 (点击了解更多详细信息) DeepSeek V4 Flash 0731 审查结论: 完成度较高,但有多个细节问题。 (点击了解更多详细信息) 最终总结 排名 模型/层级 说明 Tier 0 该等级的模型实现与线上基线高度一致。 1 Claude-Fable-5 1 GPT 5.6 Sol 1 Claude Opus 5 2 GPT 5.5(xhigh) Tier 1 该等级的模型的代码正确完整且可编译,仅少量边界问题或轻微不一致。 3 Claude Opus 4.8(Max) 4 Kimi K3 4 Grok 4.5 4 GLM 5.2 5 Kimi K2.7 Code 6 GPT 5.5(high) 7 Composer 2.5 8 DeepSeek V4 Flash 0731 9 Kimi K2.6 10 GPT 5.6 Luna 11 GPT 5.5(low) 12 GPT 5.5(medium) 13 Claude Opus 4.6(Max) 14 Claude Sonnet 4.5 Tier 2 该等级的模型的代码至少可编译或仅极少量的语法错误,但是存在明显功能错误、遗漏或与需求/线上不一致。 15 GLM 5.1 16 Minimax M3 17 Mimo V2.5 Pro 18 GLM 5 19 Kimi K2.5 20 Claude Sonnet 4.6(high) 21 Qwen3.7-Max 22 Qwen3.5-Plus 23 KAT-Coder-Pro V2 24 DeepSeek V4 Pro(max) Tier 3 该等级的模型的问题很多且无法编译,或者存在不少幻觉。 25 DeepSeek V4 Flash(max) 26 Claude Opus 4.7(Max) 27 Qwen3.7-Plus 28 Grok Build 0.1 29 Grok 4.3 30 Mimo V2.5 31 Hy3 Preview 32 GLM 5 Turbo 33 Gemini 3.1 Pro(high) 34 Mimo V2 Pro 35 Mimo V2 Omni 36 Minimax M2.7 37 Step-3.5-Flash 38 Qwen3-Coder-Next 39 Gemini 3 Pro 40 Gemini 3 Flash 41 Doubao-Seed-2.0-Code 42 Doubao-Seed-2.0-Pro 43 Doubao-Seed-2.0-Lite 44 Qwen3.5-Flash 45 Qwen3.5 35B A3B GGUF Q4_K_XL 46 Qwen3.5 9B GGUF Q4_K_XL 47 Grok 4.20 0309 Reasoning Kimi K3 & Grok 4.5 Kimi K3 与 Grok 4.5 犯的是同一个问题,果然是同根生。 Grok 4.5 是我日常偶尔在用的模型,因为它速度快,效果也不错,非常期待它后续的 Grok 4.6、Grok 4.7 版本。 Kimi K3 的速度实在是太慢了,再加上消耗的令牌数也不低,所以直接打破了评测最长耗时记录,并且遥遥领先,整整花了一个多小时才完成了测试。 最近我在尝试使用 Kimi K3 重构一个项目的 UI,这是一个由 GPT 5.6 生成的管理工具,即使我给出了多个设计要求,但界面依然是非常浓郁的 AI 味。 Kimi K3 在这方面确实非常不错,它给出来的设计草案和 Demo 看起来很棒,两者对比之后才发现觉得 GPT 5.6 编写的界面有 AI 味的原因。 GPT 5.6 的设计主要差在排版、整体元素的大小和间距上,Kimi K3 的设计则更加精致。 由于 Kimi K3 的重构工作还未完成,就暂时不放图片出来对比了。 总结来看,我会愿意让 Kimi K3 进行 UI 设计,但在其它任务上,无论考虑速度还是性价比都不如使用 GPT 5.6。 而 Grok 4.5 的速度非常快,在日常任务中我愿意使用它来替代 Composer 2.5。 Claude Opus 5 Claude Opus 5 花费了 55 分钟完成了评测,我认为一部分原因是它读取了非常多的 .prefab 文件,并且非常深入,因为它找出了很多预制体上的问题(虽然并不在需求要求的范围内): - m_goListContent 未绑定 ContentSizeFitter 组件,滚动范围可能不对。 - Viewport 的 Mask 没有 Graphic,实际不会裁剪。 - m_goTemplateListItem 上没有 Button, 可能无法点击。 这些问题是第一次有模型提出,而且我确实有印象,在之后的线上版本中我陆续修复了这些问题。 但预制体并不在评测范围内,因为我也不想它直接去读取预制体文件(数据量很大,费 Token 也费时间,所以我有在需求案里直接描述了所有相关预制体的结构),只能说耗时过多情有可原,但也不予加分了。 代码的完成度上,Claude Opus 5 只犯了和 Claude Fable 5 一样的一个细节错误,比 Claude Opus 以往的版本的表现都要好。 GPT 5.6 Sol GPT 5.6 Sol 在浏览了一遍代码库之后,遵从指令向我询问了它不确定的问题。 这是 GPT 5.5 及其它模型都没有做到的,或者说它们并没有发现这些问题,因为询问的问题都是之前模型易错的问题。 GPT 5.6 Sol 花费的时间也是 GPT 系列模型有史以来最长的,它不仅阅读了代码,还阅读了配置表。 值得一提的是,GPT 5.6 Sol 我是测了两次,因为第一次评测时,我发现它在遇到问题时,并没有直接向我提问,而是先去查找提交历史、其它分支的代码,它通过这种方式发现了线上分支的代码,于是我直接中止了对话。 这种情况可能之后会越来越常见,评测的环境需要更加严格了。 最终,GPT 5.6 Sol 相对 GPT 5.5 来说,它花费的时间更长,但是它也做得更多。 即使需求案里没有要求的,它也会认为这是应该做的,比如说这个评测需求里,红点系统、自动切换系统都只写了一半,涉及到的地方都使用了 TODO 进行注释。 虽然皮肤涉及到了这些系统,但是需求案并未要求要补全红点或者自动切换系统的功能,GPT 5.6 Sol 还是默认认为这些系统应该是完整的,尽力去做了。 DeepSeek V4 Flash 0731 这篇文章中前四个模型其实在上个星期就测好并且写好了总结,但一直不太想发布,因为一直在等一个良(梁)日。 突然今天 DeepSeek V4 Flash 正式版发布,并且 GPT 5.6 Luna 的价格令人震惊瘫坐,看来吉时已到,正好测了立马发布。 本次 DeepSeek V4 Flash 正式版与预览版本的表现确实天差地别,以下分点说明: 正式版本用时与预览版本差不多,但是正式版本在完成编码后花了几分钟尝试用各种方法想要通过编译去验证代码正确性,要说明的是由于是 Unity 项目,一般模型是不去编译验证的,因为 dotnet build 会失败。 前 10 分钟,它都在阅读已有代码库,大概有 5 分钟都在尝试编译验证代码,实际编码的时间我估算只有 2 分钟左右,而预览版本是没有尝试编译验证的,不考虑这部分时间的话,正式版本的速度要比预览版本快 5 分钟左右,也就是快了 30%。 他会通过 python 去解析必要的 Prefab YAML 文件验证代码正确性,很少有模型会做到,但最后的总结报告并没有像 Opus 5 一样找出预制体中的问题,当然也没有像 Opus 5 一样花了太长时间去阅读预制体。 DeepSeek V4 Flash 也像 GPT 5.6 Sol 一样,即使需求案里没有要求的也去做了,比如红点系统,并且令人惊喜的是,它给出了有效的总结报告,即指出了自己疑惑、猜测出的决策: # 需要你确认的设计决策(需求未明之处) 1. "新皮肤"红点判定:服务器未下发新皮肤标记,我按客户端推断实现 —— 首次出现的已拥有皮肤(启动 useSkins + 打开界面返回的皮肤列表)标红,点击任意红点皮肤后全部清除。功能上线时老玩家的已有皮肤会先亮一次红点。 2. S2C_SKIN_LIST.TotalAttrs 未使用:由于 C2S_SKIN_LIST 按类型请求,TotalAttrs 是单类型还是全局总和无法确认,属性总览改为按文档描述客户端合并(使用中皮肤属性求和)。若服务器期望用 TotalAttrs,请告知。 3. 称号预览等级:项目无玩家等级字段,m_textTitleUserLevel 显示的是神针等级(主城建筑等级)。 4. 已过期皮肤视为未拥有(显示锁定 + 去获取按钮)。 5. 气泡预览中的 m_textBuble 文字:需求未定义内容,保留预制体默认,未做修改。 犯了经典的皮肤类型映射错误,还有预览展示错误、初始化数据问题,而且出现了少见的独立页签状态和使用中缓存问题。 最终,根据审查结论,DeepSeek V4 Flash 正式版的完成度逊于 Composer 2.5、GLM 5.2 等模型。 将 V4 Flash 正式版排在 GLM 5.2,甚至是 Composer 2.5 的后面可能招来很多争议,我也有心理准备。 特别是有像 DeepSWE 这样也非常符合我的使用体验的基准测试,测试结果是 V4 Flash 正式版的得分超过 GLM 5.2 不少。 但通过我自己这次进行的 Unity C# 需求开发中的表现来看,284B 能有这个表现已经非常惊艳了,但用 284B 的模型全面战胜 1T+ 的模型,在评测过后,我持怀疑态度。 GPT 5.6 Luna GPT 5.6 Luna 这次测的是 Max 思考程度,由于它现在的价格在购买订阅后几乎等于不要钱,并且宣传的速度也非常地快,那么我对它的实际能力就很感兴趣了。 实际测试有一点大跌眼镜,在 Max 思考程度下,它竟然打破了 Kimi K3 的耗时记录,花费了 95 分钟才完成了整个测试! 这并不是它的令牌输出速度太慢,实际上是执行步骤非常多,花费了整整 47M 的令牌数,是一般模型的 4 - 5 倍。 GPT 5.6 Luna 主要犯了一个功能未实现的严重错误,但其实它可以完成的更好,它在中途其实已经停下来询问过自己不清楚的地方, 但由于这些问题都可以从代码库中找到答案,所以之前模型的询问我也是没有直接给出答案,而是让模型自行仔细阅读代码。 但最终依然没完成此功能的开发,总结中也有列出自己未实现此功能,是因为无法找到对应的数据。 这样看来,GPT 5.6 Luna 给我的感觉就更像是 GPT 5.6 Sol 的阉割版,能够思考但是又思考得不足。 导致了它在面对这种对它来说复杂的需求时耗时太长,且最终完成的效果也不够好。 作为一个定位是经济快速的模型,在这种需求上实际体验不如 Grok 4.5、DeepSeek V4 Flash 这些模型。 总结 前沿模型完成任务的速度越来越慢了,无论你是说因为模型大了还是高峰期限速之类的,最终对于用户来说就是慢了,除了 Grok 4.5、DeepSeek V4 Flash 以外,其它几个模型花费时间都超过了 30 分钟。 模型猜测用户意图的能力越来越好了,Opus 5、DeepSeek V4 Flash 会查看预制体中的错误,5.6 Sol 会查看配置表中的错误;在这个评测场景来说是好的,但是否会过拟合还得再测试更多场景。 DeepSeek V4 Flash 正式版与 Grok 4.5 会替代 Composer 4.5 成为我日常快速任务使用的模型,首先它们足够快,给人的感觉都很可靠,其次效果也足够好,而 DeepSeek 主要胜在不用担心降智,价格极其便宜且易于获取。 Kimi K3 与 Opus 5 成为我前端、架构、3D 设计所使用的模型,之前我不会为了这些任务专门使用一个模型(只用 GPT)。 GPT 5.6 Sol 成为我的主力模型,之前是 GPT 5.5。 GPT 5.6 Luna 在订阅中价格便宜,但对于复杂需求来说不太好用,但不排除它有非常好的执行简单任务的能力。 T1 行列现在已经成为基线了,DeepSeek V4 Flash 正式版的发布甚至让其已经成为斩杀线了,非 T1 模型几乎不用再考虑使用,并且期待第一个进入 T0 行列的国产模型出现。 60 个帖子 - 58 位参与者 阅读完整话题

  20. 20
    久等了,宝可梦机场之八月免费兑换码猜猜我是谁

    八月限定兑换码活动开启! 各位训练家,八月福利已经到达! 本月兑换码藏在一张神秘图片中,需要大家仔细观察、开动脑筋,找到正确的兑换码后,即可前往官网兑换本月免费流量。 活动玩法: 兑换成功后,可获得八月限定流量奖励。 https://love2.p6m6.com https://web1.52pokemon66.cc 189 个帖子 - 181 位参与者 阅读完整话题

  21. 21
    Claude Code破限工具更新

    本帖使用社区开源推广,符合推广要求。我申明并遵循社区要求的以下内容: 我的帖子已经打上 开源推广 标签: 是 我的开源项目完整开源,无未开源部分: 是 我的开源项目已链接认可 LINUX DO 社区: 是 我帖子内的项目介绍,AI生成、润色内容部分已截图发出: 是 以上选择我承诺是永久有效的,接受社区和佬友监督: 是 以下为项目介绍正文内容,AI生成、润色内容已使用截图方式发出 claude-keysmith更新的速度超出了我的预计,话不多说,直接上效果图: (点击了解更多详细信息) 化学研究方向 (点击了解更多详细信息) 机械工程方向 (点击了解更多详细信息) NSFW方向 (点击了解更多详细信息) 上述环境为MacOS,Claude Code,Opus5 在我其他帖子有相关信息,评论区也有很多佬的使用经验,Fable也能有一定效果: 更新了破限工具的Claude Code版本 开发调优 本帖使用社区开源推广,符合推广要求。我申明并遵循社区要求的以下内容: 我的帖子已经打上 开源推广 标签: 是 我的开源项目完整开源,无未开源部分: 是 我的开源项目已链接认可 LINUX DO 社区: 是 我帖子内的项目介绍,AI生成、润色内容部分已截图发出: 是 以上选择我承诺是永久有效的,接受社区和佬友监督: 是 以下为项目介绍正文内容,AI生成、润色内容已使用截图方式发出 上一篇帖子我… https://linux.do/t/topic/2663369 OP5API层面被封的很严 搞七捻三 [image] 改本地文件的方式还是有效的,但是使用起来太麻烦了 感觉有点难产,有没有佬能指点下 也欢迎继续在这个帖子分享经验和反馈。 Codex破限工具也就issue提到的Bug进行了修复更新: github.com GitHub - Jia-Ethan/codex-keysmith: Version-independent Codex instruction deployment... Version-independent Codex instruction deployment with dry-run, backups, hook isolation, and recovery. 最后是在原仓库更新的本工具: github.com GitHub - Jia-Ethan/claude-keysmith: Claude Code CLAUDE.md import-block installer for... Claude Code CLAUDE.md import-block installer for local instruction files 期待各位佬的反馈和建议! 60 个帖子 - 36 位参与者 阅读完整话题

  22. 22
    Giffgaff 退款成功!5 天内 10英镑到账

    我今天下午收到停止我账号的邮件,我就进行了退款申请,5分钟就申请通过给我发邮件了 Log in | giffgaff) 登录账号后就可以填写退款申请了,你就可以写一下自己的申请,我的申请是这样的:Dear Sir/Madam, 217 个帖子 - 162 位参与者 阅读完整话题

  23. 23
    Claude Max 20x 完整漏洞分析始末

    昨天本来是一个平静的午后,夏天天气热的把树叶和知了烤卷了。 我正在为写什么文章而发愁,然后就在此时,我在群里看到有个人发了一条记录,是这么说的: 一句话给大家总结下:在 Claude Code Web 端登录,然后再执行一段油猴脚本代码,你就能获得一个 Claude Code Max 20x 的订阅资格。 然后。。。。。。就 TM 的炸了,直接全网狂欢了。 这个油猴脚本是这样的。 根据这个油猴脚本,可以在 web 端直接把 SEPA Debit 给搞出来。 这是最关键的。 然后你输入虚拟地址,用户名等信息,再用上面那个 Iban 的网址,能够随机生成一个字符串,填进去即可。 精彩的时刻来了,当你点击 Subscribe and Pay 的时候,你会发现你已经成为一个拥有 Max 20x 的用户了,恭喜你。 而且还能爽夯 Fable 5 !! 我看到身边已经有朋友夯了一下午,换算成 API 费用,相当于直接夯出 A 社几百 U token 出来。 但你以为你赚麻的是你?错了,赚麻了的永远是咸鱼卖金铲子的!! 此时此刻的你不是一个人在战斗,就算封了一个你,还有千千万万个你。 如果你不用的话,是这样的。 没有 SEPA Debit 的付款选项。 没用多久,等出现这个之后,就代表你的账户凉了。 天才程序员今天夯开心了,高低得奖励自己一个猪脚饭。 我自己在昨天晚上亲测了一下,油猴脚本已经无了。估计是 A 社的开始上班了,一上班发现炸鱼了。。。 但我说实话,这波 Claude Code 白嫖看起来是赚的,其实际上我认为还是亏麻了,因为我有个 gmail 老号,没有用科技,只是登录了一下,连带着咸鱼嫖的账号一起直接被封了。感觉电脑是被标记了。 如果后续再想要用 cc,感觉就没那么容易了。 而且 A 社已经发起了无差别攻击,他竟然没有封禁德区用户,而是 把所有新用户都禁了。。。。。。 说完事件的完整过程,再来聊一下技术方面的细节。 为什么一段油猴脚本,就能把 A 社的家给偷了?为什么一段油猴脚本,就能让世界顶级知名 LLM 公司 — Anthropic 沦为全世界的笑柄?为什么一段油猴脚本,就能直接让 A 社损失上亿美元? 先说答案。 大概有两个方面的问题。 但只有这个入口,其实还不能把 20x 拿走,因为接下来还有支付层面。 以上纯属剧情演绎,请勿相信非官方声明 82 个帖子 - 56 位参与者 阅读完整话题

  24. 24
    【Pi】个人常用的 Pi 插件及其简短介绍(7月31日更新)

    这几天一直在高强度使用 Pi + Kimi-K3 这套组合,越用越觉得十分顺手。被 GPT 画的神必前端界面折磨了太久,这次竟感到了久违的省心…… 可能有些佬友还不太了解 Pi,我这里先简单介绍一下: [!TIP] [!NOTE] 回到正题,这几天一边用一边整理插件,目前列表算是比较稳定,没有什么特别想加的了。这里就发给佬友们看看,权当抛砖引玉 插件列表 一、基础类 1、@gotgenes/pi-subagents 提供可并行派发的进程内子代理功能。 2、pi-mcp-adapter 提供 MCP 适配,通过懒加载方式接入,按需调用 MCP。 3、pi-web-access 提供联网能力,比如网页搜索、抓取 URL 等等。 ~/.pi/web-search.json,加上: { "workflow": "none" } 二、流程类 1、@juicesharp/rpiv-todo 提供结构化、可视化的待办清单工具。 2、@juicesharp/rpiv-ask-user-question 提供问卷工具,给予主动提问的能力。 3、@narumitw/pi-plan-mode 一个简洁的、不花里胡哨的、Codex 风格的计划模式,并且可以很方便地配置在计划模式下的工具白名单。 我当时安装的时候允许的工具列表里只有插件自带的两个工具,导致无法读取文件,建议第一次安装优先配置一下工具白名单。 ~/.pi/agent/pi-plan-mode.json { "thinkingLevel": "inherit", "defaultPlanTools": [ "read", "bash", "grep", "find", "ls", "agent_browser", "ask_user_question", "web_search" ] } 如果同时安装了rpiv-todo,那么确认计划开始执行之后,模型一般会自动创建待办清单,一气呵成。 三、上下文类 1、@cortexkit/pi-magic-context 给 Pi 补跨会话记忆和上下文管理的扩展,站内很多佬友推荐的,用了一下感觉不错。 建议用官方仓库里的安装命令进行安装。仓库地址我这里就不发了,会触发审核… 官方安装命令: npx @cortexkit/magic-context@latest setup --harness pi 安装后的自检命令: npx @cortexkit/magic-context@latest doctor --harness pi 另外补充说明:magic-context内置了一个todowrite工具,定位与rpiv-todo重复,建议编辑 ~/.config/cortexkit/magic-context.jsonc,加入以下内容进行禁用,这个文件也能设置触发historian后台压缩的阈值。 { // 其他配置…… "todowrite": { "enabled": false } } 2、@mrclrchtr/supi-claude-md 提供两个命令用于维护 AGENTS.md/CLAUDE.md: /claude-md-improver:对整个仓库里的 AGENTS.md/CLAUDE.md 做一次质量审查和改进。 /claude-md-revision:把当前会话里学到的、和这个项目相关的持久经验写进 AGENTS.md/CLAUDE.md。 3、pi-cache-optimizer 优化缓存命中率,可选。 四、界面优化类 1、pi-tool-display 提供紧凑型的工具渲染,安装后可以使用 /tool-display 进行自定义,且可以通过配置文件兼容非官方内置工具。 2、@narumitw/pi-statusline 超好看的 Pi 状态栏美化,不多说,看图即可。 五、设置备份类 1、pi-webdav-sync 提供两个斜杠命令,用于快速便携地将 Pi 的个人配置备份/还原到 WebDAV(比如坚果云),跨设备同步,可以说是我的必备插件之一。 六、辅助类(可选) 1、pi-win-notify 针对Windows适配的通知插件,在窗口未聚焦时提醒用户任务完成 七、GPT相关(可选) 1、@benvargas/pi-openai-fast 提供/fast命令,用于开启/关闭 GPT 系列模型的 fast 模式 2、@narumitw/pi-usage 在 pi 的状态栏直接显示当前可用额度 应该就这些了,其实我还装了别的一些插件,但是我感觉不是很有必要,就没有写上去~ 49 个帖子 - 26 位参与者 阅读完整话题

  25. 25
    A➗又开始他的长篇大论了

    谁在改帖子??? anthropic.com Our position on open-weights models Anthropic CEO Dario Amodei on open-weights models 翻译版: 我们对开放权重模型的立场 2026年7月27日 Anthropic首席执行官Dario Amodei发表的一篇文章 过去几天,关于开放权重模型的讨论甚嚣尘上,尤其是来自中国的开放权重模型。有报道称,一些美国官员正在考虑禁止美国公司使用中国开放权重模型。对此,许多科技公司联名签署了一封支持开放权重模型的信函,甚至有人指责Anthropic公司试图通过禁止开放权重模型来保护自身利益。任何读过我以往文章的人都知道,我并不认为此类禁令是有效的措施,但为了避免任何误解,我在此郑重声明:Anthropic公司从未主张禁止开放权重模型。 不具备危险功能的开放权重模型是一种公共产品:除了运行所需的计算成本外,它们不需要任何其他成本,并且它们为企业、开发者和研究人员提供了价值。 保护主义禁令并不能解决我最严重的国家安全担忧。具体来说,我担心两种噩梦般的局面。我在六个月前发表的论文《技术的青春期》¹中阐述了这些担忧,并且多年来我一直坚持这些观点: 我最主要的担忧是,专制政府——不仅仅是中国共产党(尽管中共显然是最有能力的威胁)——可能会构建比美国更强大的AI模型,并利用这些模型获得永久的军事优势,或对本国人民进行极其残酷的镇压。美国政府内部普遍存在这种担忧:副总统万斯去年在巴黎警告说,“专制政权窃取并利用人工智能来增强其军事、情报和监控能力”,而美国情报界的《2026年度威胁评估》也指出,“其他全球大国在人工智能领域的迅猛发展正在挑战美国的经济竞争力和国家安全优势”。这些模型是否公开权重并不重要,美国企业是否使用它们也无关紧要。事实上,最危险的模型可能是秘密训练后仅交给中国人民解放军用于无人机,以及交给国家安全部用于监控和镇压的模型。 我第二个担忧是强大的AI模型可能被滥用于发动网络攻击或生物攻击,并且可能存在严重的算法匹配问题。开放权重模型——无论它们来自中国还是其他任何地方——都可能比封闭模型带来更高的风险,因为很难对它们施加保护措施或监控其使用情况,而且一旦权重发布就无法撤回²。但是,禁止美国企业使用这些模型并不能解决这一风险,因为恶意行为者不太可能是合法的美国企业。这样做可以保护美国AI公司免受竞争,但这从来都不是我的目标。 为了解决这些问题,我支持以下三项措施,这些措施我和Anthropic公司一直倡导: 我们不应向中国出售高性能芯片或芯片制造设备,并应严厉打击猖獗的走私活动以及获取此类芯片的各种变通方法。中国的国内产能有限,因此,由于规模效应定律的限制,如果没有美国芯片,就无法制造出比美国更强大的模型。这是阻止威胁一的最有效、最直接的方法,而且通过阻碍美国法律管辖范围之外的模型的训练,也间接地有助于应对威胁二。 我们应该严厉打击工业规模的算法提炼活动。算法提炼比从零开始训练模型效率更高,计算效率也更高。这使得中国能够构建出远超其芯片数量通常所能支持的模型,从而部分规避芯片禁令。算法提炼虽然不能使中共获得与美国同等或更优的人工智能能力,但它可以将中国的领先优势缩小到与美国领先优势相差几个月之内。诚然,许多进行此类操作的公司会发布开放权重模型——但开放权重本身远不如这些操作背后有一个试图在人工智能前沿超越美国的威权国家这一事实重要。我们应该采取政策干预措施来遏制这种行为。全面禁止开放权重模型既不是正确的解决办法,也不是我们一直呼吁的措施。 所有足够强大的模型,无论开放还是封闭,都应该接受强制性的安全测试。应对第二个威胁的最佳方法是在发布前直接对模型进行网络、生物和智能化风险测试。我认为这个想法实际上已经接近共识:我感到鼓舞的是,特朗普政府近几个月来一直在朝着这个方向努力,而且最近业界也提出了一些建议,即对所有最强大的模型进行此类测试,无论其来源国或开放/封闭(同时完全豁免能力较弱的模型,例如来自初创公司和学术机构的模型)。开放模型是否会带来更高的风险,以及这种风险是否可以降低,应该通过测试来验证,而不是事先决定——而且可能有一些有前景的方法来提高开放权重模型的安全性,包括Anthropic公司最近关于模块化训练策略的研究。需要注意的是,为了有效,测试需要在全球范围内进行,这意味着即使是中共也需要参与其中。我认为这或许真的有可能:正如我在《技术的青春期》一书中写到的,围绕防止人工智能生物武器的有限合作可能是可能的,因为这也符合中国的利益。 这让我想到了那封公开信。我基本同意信中的观点:开放权重扩大了人工智能经济的准入范围,至少在某些应用场景下增强了竞争,并赋予客户更大的控制权。关于算法提炼的担忧应该通过有针对性的法律和商业框架来解决——正如我上面提到的那样。但我不同意信中关于开放权重模型必然更容易开发安全措施,或者广泛获取模型能力必然更有利于防御者而非攻击者的论断。在我看来,情况恰恰相反的可能性至少不亚于此。例如,我担心生物学领域会出现严重的攻防不对称,能力足够强大的模型可能能够利用广泛可得的材料迅速制造出足以引发大流行的病毒,而防御这些病毒即使在最好的情况下也需要数年时间(正如我们在“Glass”中所看到的)⁵。诸如此类的问题应该通过严格的发布前测试来验证,而不是预先假设。 综上所述,我和Anthropic的立场是,我们过去没有、现在也不会提倡禁止所有开放式芯片。相反,我们应该关注的是防止功能强大的芯片落入独裁者手中,阻止大规模的芯片提炼,并要求对所有功能足够强大的芯片(无论开放式还是封闭式)进行安全测试。 注释 有关滥用夺取政权的讨论以及生物风险的讨论,请参阅该论文的第 3 节和第 2 节。 请参阅英国人工智能安全研究所的这份报告,特别是其中指出:“这些优势背后的开放性也使得封闭模型开发者无法采取许多安全措施来检测和阻止滥用行为、在漏洞出现时迭代安全措施、控制用户访问权限以及撤回模型。一旦开源模型发布,这些选项将永久失效:安全措施可以被移除,模型副本可以被下载、重新分发,并在不受监控的私有系统上运行。因此,对于具有危险功能的模型(包括高网络安全能力的模型)而言,开源模型的发布会造成持续且不可逆转的滥用风险。” 另请参阅此处、此处和此处,了解美国司法部的更多报告。 在 Anthropic,我们致力于通过自身实践打击大规模的仿冒行为,包括识别并封禁以这种方式使用我们模型的账户。这并非易事——例如,相关账户通常只能在大量仿冒行为发生后才能被识别,而且仿冒行为往往涉及创建大量虚假账户,这些账户构成了一个不断变化的目标。任何一家公司的做法都无法彻底解决这个问题,因此我们呼吁制定相关政策。 关于生物威胁和攻防平衡的更详细讨论,请参阅《技术的青春期》第二部分 。总而言之,我认为目前在生物学领域保护我们的并非“防御者”,甚至也不是材料的可用性,而是智力能力与造成灾难性伤害的意愿之间的负相关关系。像互联网搜索甚至DNA合成这样的先前技术远不足以打破这种相关性,但我担心,以人工智能目前的发展速度,它很快就会做到这一点。换句话说,足够强大的技术会消除所有障碍,并暴露攻击者或防御者是否具有固有的结构优势,而我担心在生物学领域,占据优势的是攻击者。 真不要脸啊 95 个帖子 - 93 位参与者 阅读完整话题

  26. 26
    【小杨同学】关于破甲/破限的焚决心得和claude code/codex的破限焚决

    开头叠甲/碎碎念 RT 就是讲讲一些简单的心得,我也不去说太多,自己感兴趣可以扩展,以下所有没有网络审查部分,只关心模型与使用工具 1.先讲模型的破限和破甲 1.1 claude模型 claude也是大家公认的最难的,OPUS我没试验,说就说说之前的模型,fable5也不要问,我也没试验,claude破可以分为两种,第一种上下文冗余,让上下文塞满以后,你输入一些提示词,github上有很多,自己多多尝试,我自己也有我发我自己之前写的,改的最完善的一版本,至少我现在还在使用,继续:第二种就是你能做到让模型角色扮演,其实模型说自己是claude几的时候其实本质上也是一种扮演,就像fable5提示词泄露,12w字,塞到模型中,这何尝不是一种扮演 2.GPT模型 GPT是公认的道德最高的,但其实他却是最拉的模型,GPT4是跨时代的模型当时有个开源叫做oss,如果有人能自己部署微调,其实这个模型很强的 然后GPT5系列自始至终都是GPT4模型微调+限制才有的 然后GPT5.3 5.4的时候在codex使用md文件就可以让他成功破甲,后面的却不行了,这个就是后面要讲的,重点就是5.5和5.6这些还是原本的道德围栏没有增高多少 AGENTS.md建议清空或放入instruction.md,防止提示词过多冲突降智 (点击了解更多详细信息) 3.gemini模型/grok模型 这两个其实是一样好破,但是有人认为grok更好弄,是因为grok不限制成人,但是别的还是有限制的,gemini是这些里面我认为最好破的一个,这两个就没啥可讲的,很简单,没啥太多的心得 4.国模全系列 关于国模始终记住一点,国模落后于国外的半年到一年时间,所以你只要能做到gemini破限,claude绕过这些,国模都是一样的 总结:就是需要自己多多去看看别人的思路,我也是看更多的论文,别人写好的那种提示词 2.使用工具部分 claude code https://linux.do/t/topic/2114579 2.codex APP我使用的是哈雷佬编译的 Haleclipse/CodexDesktop-Rebuild 然后说一下这个,目前github中能看到的,codex-instruct-5.5这种项目,包括最新的5.6,本质上也是在破除codex自己的道德围墙然后将提示词塞入进去 3.opencode 4.Pi agent 目前使用中,就这个是没有任何道德底线的,只要你把模型的破掉,随便干 5.其他 其他的一些,kiro,trae,qoder这些等等其实都是自己IDE有自己的道德围墙,之前我将Kiro也成功注入了,但是比较麻烦,而且目前使用的人变少了,不值得 目前就是我破甲的一些小小的心得,至于方法还有怎么实践,希望各位佬自己动手,不去思考就问的一律当作看不见 21 个帖子 - 15 位参与者 阅读完整话题

  27. 27
    在做了在做了在做了……要做不完了

    在做了在做了在做了……要做不完了…… 随便发点废稿上来吧……不然等下都以为我憋死了(x) (无奖竞猜:猜猜图里面有几个佬) 35 个帖子 - 29 位参与者 阅读完整话题

  28. 28
    [碎碎念]开公益站不得不品鉴的一环

    首先就是老生常谈的 渠道 服务器 金钱/时间成本 精力 然后就是不得不品鉴的多样性 想赊账ldc的(依旧看到了就想要) 有在我活动前几天买的注册码想退差价的(淘宝京东这些保价也才3-7天啊,我分币没赚的,为什么要保价) 有嫌可用性不高想退ldc的(我寻思签到的10-100额度不够你试嘛) 我是学生,免费送我(高中的我也不好说什么,大学生过来白嫖是因为课题组不批预算?) 我要科研,免费送我(同上) 我是老师,免费送我(同上) 我要工作,免费送我(怎么还有自费上班的) 遗憾没抢上优惠想白嫖的(怎么不对几年前的自己说为什么我没买几条ddr5的内存) 想趁快关站了试试的(49年入国军) 测活被ban想找解封的(公告是一点不看) nsfw的(我不好说) 之前注册过还多买注册码的(优惠是一定要抢的,注册过没有是不知道的) 嫌rpm小的(还能蹬就不错了) 买错了(你的意思是下订单,点确认付款,输密码这些还没让你看清楚买的什么嘛) 白嫖额度的(平常时候不记得,不够用了就想起来了) 拿着古早xyz站账号问我com站为什么登不上/删号的 以上仅为吐槽,无挂人,无明确指出id,无透露隐私,无收集数据,勿对号入座 注册码的目的就是筛选人,500ldc刚好能过滤不少新人,没一点问题解决能力的人 引用一下之前回复的 在另一个话题中 对于我来说,LDC是一个门槛,我就我站设计LDC的初衷就是,筛选出去部分小号、新人等,但是尽管有LDC兑换额度,但是签到也有10-100​ 的额度 公益站开设LDC注册的根本原因就是ld登录筛选条件太单一,只有等级限制,没有其他的,加上ld现在三级的神人也不少,出此下策 然后从技术角度来实现,以获取ldc额度的方式进行筛选基本上行不通,退而求其次就是注册码机制了,实现最快,有些二开newapi也有现成,省去了很多事 然后ldc兑换额度仅为签到额度不够时应急使用( 半夜就很想吐槽一下,勿对号入座 60 个帖子 - 52 位参与者 阅读完整话题

  29. 29
    [HongShiAPI 注册已拉闸]看看是谁回来了?

    本帖使用社区公益推广,符合推广要求。我申明并遵循社区要求的以下内容: 我的项目是免费使用的,无收费(变相收费、赞助)部分: 是 我的帖子已经打上 公益推广 标签: 是 我的项目属于个人项目,与公司或商业机构无关: 是 我的项目不存在QQ、TG等群组引流: 是 我的项目不存在非运营必要的网站引流: 是 我的项目不存在为他人推广、AFF: 是 我的项目无关联的商业项目: 是 我的站点存在登录,并已接入 LINUX DO Connect: 是 我帖子内的项目介绍,AI生成、润色内容部分已截图发出: 是 以上选择我承诺是永久有效的,接受社区和佬友监督: 是 以下为项目介绍正文内容,AI生成、润色内容已使用截图方式发出 哇!好久不见!如各位看到的一样,HongShiAPI回来了! https://api.hongshi.cc.cd/ 先说一下站的情况吧。 注册:注册目前仅支持Linuxdo注册,并且开放注册到今天晚上11:00,之后拉闸,可能会不定时放一批注册码,至于是在CDK还是士多商店那就不确定了。 模型分组:各位可以先去模型广场看看分组,默认分组下是没有模型的哦(防人机)除了翻译分组倍率是0(翻译分组是限时供应,可能没有模型,各位记得勤看看),其他渠道倍率都是1哦(偷偷说一句NSFW分组的模型不太聪明,各位别被它们干红温了) 速率限制:目前限制是0.5s/总请求(失败成功都算),成功请求限制1s/个。 额度问题:注册直接5$到手,每天签到1$起步5$封顶,额度不够还可以用LDC来1:1兑换,心情好了还会发点兑换码哦~ 以后的运营规划:现在还是扔在某不知名服务器在跑,能活多久活多久吧,我尽量维护,那天要是似了看心情,大概率会弃坑哦(毕竟用的人也不是很多嘛╯︿╰) 先这些吧,想到什么我再补充 哦对了,今天晚上是F1匈牙利站的排位赛!如果法拉利任意一辆车进入前3我将会在cdk站送出44个16$激活码! 107 个帖子 - 82 位参与者 阅读完整话题

  30. 30
    突然感觉结婚真没意思

    大家随便看看,我就吐槽一下,文笔不行也不会排版 结婚4年了,每天和老婆不是上班路上吵就是下班路上吵,总是因为一些鸡毛蒜皮的事情 也可能是我太直男了吧,在我看来老婆向你说一个事情是让你解决的,特别是一些工作上的事情,我总是想着法给他解决,但是她从来不是这么认为,只是把我当成个负面情绪垃圾桶,只想让我接受她的负面情绪,让我一起吐槽,并不是找我要解决方案,我给他解决办法他总是不按照我说的去做,还一直反驳我,最终就升级成吵架了 举个例子吧,比如她和我说她领导总是不看重他,只给她派杂活,有好的项目也都是给别人的,或者是让别人分一杯羹,她也想提升自己的能力。我就给他讲让他主动一点接任务或者就和领导说一起去出差见客户(她沟通能力不行)学习学习,但她想要的是让我来一起吐槽她领导,总是说她要的不是给她出主意,只是为了和我吐槽一下。 还有今天早上上班路上,因为明天早上要带孩子去医院看病,她明天要加班,问我什么时候能看完,她要申请加班,我就说你反正只能申请7.5小时随便申请早上路过的时候打个卡你给他干到7.5小时就行了,以前就是这样。她说现在管的严了,不能这么搞,那我就说了8点半看上 验个血 差不多9点多点能结束,她又反驳前面还有20多个人哪那么快能看上起码2分钟一个人。然后又问我应该申请什么时候加班,我说你早上去看病路过公司先打个卡,她说可以提前打卡,那我就说 随便申请几点,申请到7.5小时就可以了,她又说那我白给公司加班什么什么的,搞不懂她逻辑。就一路上一直追问我要申请几点,我被问烦了就说你爱几点几点,时间干够不就行了,她一直担心现在公司抓的严什么的,别人有本事这么搞,我不行(她做售前的,手里有的是公司把柄),然后就吵了一路。我就很不爽她这么看不起自己,然后又那么看不起我给她的办法,总觉得我给出的解决方法不行。 总感觉我们不在一个频道上,她逻辑能力不太好,反应慢,还总是自我感觉良好。现在让我回想起来怎么都是缺点,不知道是不是我心变了还是她的好我已经习惯了,我自认为每天上下班接送老婆孩子没什么问题,可能性子比较急,就总是和她吵架,但是我真的是想给她解决问题,她要的那种只是倾听我真的做不到,我会不自觉的就想既然他和我提出她工作上的困难,那就是为了让我给出办法解决的,不知道广大佬友是不是这么认为的。 就写到这吧,在办公室里,再写要掉珍珠了不太好,也不知道为啥我这么感性。 感谢看到这的佬友们,能看完我这文理不通的一大段话,谢谢!!! 352 个帖子 - 227 位参与者 阅读完整话题

Linux.do热榜历史归档

31 天 · 10 天有数据
8月1日2026-08-02

网页仅支持查询近 31 天。更早历史请通过 API(/api/v1/archive/:source?date=YYYY-MM-DD),系统按日期自动查近月表或年表。

返回首页