登录社区云,与社区用户共同成长
邀请您加入社区
回顾全文,DeepSeek 的涨价并非孤立事件,而是大模型行业从低价获客走向可持续商业化的一个缩影。它促使开发者和企业重新审视供应商锁定风险,也把模型能力、价格与工具链的整合推到了选型决策的中心。以 GLM 5.3 为代表的新一代模型,在编程、网络安全和长上下文等关键场景上展现出接近甚至超越国际主流模型的能力,同时通过开源与开放生态降低了迁移门槛;DeepSeek Harness 与 ZCode
DeepSeek 新开源的 Agent 运行时,核心理念 **"一切皆插件"**。| **safe-find-dsh-plugins** | 按需求自动查找插件|| **dsh-turn-rewind**| 一键回退|| **dsh-paste-input**| 粘贴 / 拖拽文件到对话框|| **dsh-browser-panel** | 内嵌浏览器,让 Agent 操作网页|
DeepSeek Harness v0.1是一个开源的Agent运行时框架(MIT协议),核心定位是"智能体底座",通过模型推理+环境交互实现任务闭环。其特色包括:1)基于Cordis微内核的插件化架构,所有功能模块可动态配置;2)提供标准/PTC/极简/创造四种运行模式,其中PTC模式能显著减少工具调用轮次;3)专为开发者优化,支持代码修改diff、任务轨迹追踪、沙箱权限控制
DeepSeekHarness(dsh)是DeepSeekAI开源的AI开发框架,基于"一切皆插件"的理念构建。本文详细介绍了dsh的环境配置、四种安装方式(npx/全局安装/源码/Docker)、四种运行模式(标准/PTC/极简/创造)以及插件系统管理。重点包括:1)API Key安全配置方法;2)PTC模式通过TypeScript代码减少调用往返;3)插件开发入门示例;4)
摘要: 本文针对大模型API选型提出实用建议,强调应基于业务场景而非盲目追求“最强模型”。对比国内固定额度计费(预算可控但灵活性低)与海外Token按量计费(精准公平但需用量管理)的优缺点,并给出选型流程:先明确业务需求(如代码、创作、长文档等场景),匹配推荐模型(如DeepSeek、Claude、GLM等),再通过实测用量选择计费模式。文章指出常见误区(如过度追求新模型),建议初期免费测试,长期
DeepSeek API价格大幅调整引发开发者讨论。调价后高峰时段输出Token成本涨至4.5倍,V4-Pro缓存命中输入更是暴涨12倍。开发者面临三个选择:1)优化调用策略,如错峰使用、精简上下文;2)切换竞品API,但需重调Prompt和测试兼容性;3)搭建模型路由实现负载均衡,但增加运维复杂度。建议个人项目可优化调用,中小工具尝试竞品迁移,商用项目考虑路由方案。长期来看,避免单模型依赖、保持
性能更强:新版本的 Flash 比老版本的 Pro 更强大网络优化:使用国内 API,无需代理界面友好:提供图形化交互界面开发便捷:支持直接交互修改,特别适合 Web 开发建议当前使用 Flash 版本,待 Pro 版本更新后再考虑切换到 Pro。
《AI时代程序员的生存法则:从代码执行者到决策架构师》 在AI技术爆发的2026年,程序员面临灵魂拷问:当Claude能理解百万行代码、GPT能自动完成开发全流程时,人类的价值何在?视频揭示了软件工程3.0时代的三层新架构:人类上移至决策层(业务判断/伦理审核),AI承担执行层(代码生成/测试部署),交付标准升级为可维护系统。程序员需转型为"AI指挥官",掌握三大核心能力:全局
本文介绍了如何在Claude Code中通过环境变量配置使用DeepSeek模型,并重点解决了旧API密钥失效导致的401鉴权错误问题。关键步骤包括:1)设置ANTHROPIC_BASE_URL和ANTHROPIC_AUTH_TOKEN两个核心环境变量;2)修改密钥后必须重启终端才能生效;3)提供了单独更新密钥的PowerShell命令和验证方法。文章还分享了使用小技巧和注意事项,帮助开发者正确配
DeepSeek-R1 的小模型用了蒸馏,但旗舰 R1 本身不是简单复制国外模型,它建立在自己的基础模型之上,并使用了大规模强化学习。普通公司不需要部署完整的 R1,也能用较小的显卡获得接近大模型的推理能力。可以把它理解成老师带学生:让能力更强的大模型生成答案、推理过程和训练数据,再拿这些内容训练一个更小、更便宜的模型。直接使用开源模型,再加上合成数据和蒸馏,几个月就能得到一个看起来不错的模型。能
作者在制造业数字化转型中将AI应用从RAG(检索增强生成)升级为AI Agent的实践过程。文章对比了RAG与Agent的核心差异:RAG仅能被动回答问题,而Agent具备主动调用工具完成任务的能力。作者详细介绍了技术选型(Qwen2.5模型+LangChain框架)、项目结构设计、四个核心工具(计算器、时间查询、文件读写、知识库检索)的实现要点,以及Agent构建过程中的关键决策和工程化心得。文
构建Karpathy同款AI知识库:三步搭建自动化个人维基 摘要:OpenAI研究员Karpathy公开了一套基于LLM构建个人知识库的极简方案:①创建raw/wiki/outputs三个文件夹分别存放原始素材、AI整理内容和生成报告;②通过Vercel的agent-browser工具自动化抓取网页内容存入raw文件夹;③编写CLAUDE.md说明书定义知识库规则,让AI自动将杂乱素材整理成关联性
重启日记第十五周,公司启用 Cursor 辅助编码大幅提升开发效率,业务迭代饱和挤压写作时间,本周仅发布 1 篇博文,周阅读、排名明显下滑,但原力分连续十五周稳步上涨。坚持主业优先、宁缺毋滥不凑水文,彻底看淡短期数据起伏,接纳低更新节奏,专注长期内容沉淀。
AI时代真正的出路是:能把AI生成的软件纳入一套可验证、可审计、可交付的工程流程,建立一套自己的AI工作流。AI时代不缺代码生成,缺的是可信交付。
摘要:2026年6月,Anthropic的AI编程模型Claude Fable 5上线仅72小时即因安全漏洞被强制下线,引发行业震动。该模型展现出超强能力(如1天完成人类团队半年的工作量),但暴露了AI安全评估标准滞后于技术发展的矛盾。事件导致AI行业转向"安全审查先行"模式,企业需关注API稳定性风险、开源模型部署等应对策略。开发者建议建立多模型冗余方案,关注合规要求,制定应急预案。这标志着AI
AI Agent的本质是"同时做多件事"——并行调用多个工具、并发请求多个LLM、一边流式输出一边处理结果。但大多数Agent代码还在用同步阻塞写法,一个LLM调用等3秒,5个串行就是15秒。本文不讲asyncio基础概念,直接聚焦AI Agent场景中的6个高频异步模式:并发LLM调用、工具并行执行、流式处理管道、信号量限流、超时熔断、混合同步异步——每个都给出可复制粘贴的生产级代码。
本文介绍了Claude Code的两大核心配置机制,帮助用户从基础使用提升到高效开发体验。第一部分详细解析了settings.json权限配置文件,包括三级配置层级、核心权限控制、模型选择策略及上下文压缩等关键参数设置。第二部分重点讲解三层记忆体系,特别是CLAUDE.md文件的作用机制,从全局级到文件夹级的分层配置策略,让AI能持续记忆项目背景和技术规范。通过合理配置这些功能,可以显著解决AI"
本文介绍了Claude Opus 4.6在架构设计分析方面的能力范围。其擅长代码级架构理解、设计模式识别与建议、重构分析以及系统级概念讨论;在大规模系统设计和特定云平台架构方面存在一定局限;不擅长组织维度的决策和深度性能调优。最佳使用场景包括代码架构解析、新系统设计讨论、重构决策等。总结来说,它像一个经验丰富但缺乏实战直觉的高级工程师,适合架构分析与讨论,而非生产环境的具体实施。
每个平台都要单独注册、充值、维护API Key。我实际测下来,成本大概降了15%~25%。我感觉这种“AI网关”,未来会变成标配。简单说,它是一个AI模型聚合网关。更关键的是,它会自动帮你选模型。我最近换了个方案:ZenMux。(注册有额外Credits)写代码用Claude好一点。你不再为AI的不稳定买单。有时候还得用Gemini。✔ 不用再纠结选哪个模型。👉 你很难只用一个模型。不用再维护多
了解 Harness Engineering 的朋友都知道,无论是 Claude 还是 Codex,在启动时都会加载 skills 里的元信息。/writing-plans:编写计划(我仅使用了 /gsd-plan-phase,两者二选一即可)/gsd-new-project:将 Gstack 确定好的方案 “钉住”/plan-ceo-review:检查产品方向的合理性。/plan-eng-rev
本文内容由 Kimi AI 根据阿小信(axiaoxin)公开网络资料自动整理生成,包括博客、GitHub、微博等渠道。所有语录均为阿小信本人公开发表的原话或基于原文的准确提炼,未做改编,仅按主题归类。“35岁,我从自由职业到一人公司:2025独立开发者’生存与搞钱’复盘”—— 2025年度总结标题“2025年自由职业第二年,虽多坎坷(AdSense账号停用、被约谈、版权问题等),但稳步适应。收入
本文介绍了AI编程平台MonkeyCode,它集成了GPT-5.5、Claude 5、Qwen3.6、minimax m2.7等顶级大模型,具备强大的项目上下文理解和团队协作功能,分享了正在进行的免费活动:每天早上10点释放500亿Token,完全够用。通过一周的真实使用体验,从代码质量、开发效率和团队协作三个维度进行了评测。如果你需要一款高效的AI编程工具,MonkeyCode值得一试。
【摘要】陕西蓝吉创想网络科技团队创新性地采用"结构化提示词+AI生成+人工微调"的工作流,将软件定制开发的原型确认周期从传统5-10天压缩至4-8小时。该方案通过GPT-4o生成代码、Claude-3.5审查和人工优化,实现家政预约等常见场景的快速原型开发。实践数据显示,项目平均原型制作时间5.2小时,开发周期缩短42%,客户满意度达9.1分。该方案特别适用于信息展示类应用,为技术团队提供了AI时
苹果新增搜索广告位的当天,千问核心技术负责人突然离职——巧合吗?不,这是一面照妖镜。
本文分享了使用TraePro开发工具快速完成"悦动打卡"微信小程序的体验。该工具实现了"一个人的研发部"构想,仅用3小时就完成了包含运动打卡、微信步数同步、好友组队等核心功能的小程序开发。TraePro作为全流程AI开发助手,能理解需求、生成原型、实现架构并快速迭代,开发者只需用自然语言描述需求即可。小程序支持自定义运动类型、团队目标管理、动态互动等功能,并
摘要:Anthropic公司遭遇重大源代码泄露事件,ClaudeCode的51.2万行TypeScript代码通过npm注册表意外曝光。泄露包含核心架构、工具模块和未发布功能,如自主守护进程"Kairos"和电子宠物系统。代码中还发现Claude Mythos 5.0(代号"卡皮巴拉")的踪迹,以及特殊功能如"卧底模式"。该事件迅速引发开