登录社区云,与社区用户共同成长
邀请您加入社区
本周 AI 技术栈出现两条相互咬合的结构性变化:OpenAI 首款自研推理芯片 Jalapeño 以 700 瓦击败英伟达额定 1200 瓦旗舰、响应快 3.6 倍,把"每瓦性能"推向竞争前台;与此同时,DeepSeek-V4-Pro 采用总参数 1.6 万亿、每 token 仅激活 490 亿的混合专家架构,Qwen4 预览则以 510 亿参数作片段索引嵌入,模型侧的稀疏化设计正与芯片侧的能效优
从写代码、做对话,到开始动手“画电路图”、“造打工芯片”,AI领域的竞争已经从软件层面的算法厮杀,彻底卷到了最底层的硅片上。
近期,通义千问 Qwen3.8-27B 正式 Apache2.0 开源,作为 27B 稠密原生多模态模型,官方基准显示其代码、办公、Agent 能力超越前代 Qwen3.6-27B、我们测试中,在编程 / Agent 赛道可对标云端 Qwen3.7-Plus,把旗舰级底座能力下放到 24G 消费级显卡可运行的本地环境。搭配强化后的多模态能力,可精准识别截图、复杂PDF、长视频内容,具备解析界面、完
要保留长程记忆,就在砍之前先总结。把超出窗口的旧轮次交给模型压成一段摘要,替换进上下文。这样模型既不被旧信息淹没,又不丢关键事实。context_summary = "" # 跨轮累积的对话摘要# 摘要用与主回答相同的模型即可;想更省可换成 deepseek-v4-flash(以控制台模型广场为准)messages=[{"role": "system", "content": "把对话压缩成一段中
开源AI工具插件生态爆发增长,两天内从300个激增至3000个,多个第三方插件商店抢占流量入口。但同质化严重,记忆管理、多Agent协作等通用功能插件已过度竞争。真正难以复制的价值在于插件背后连接的独占数据或行业工作流,而非代码本身。建议开发者将核心能力封装为通用接口,而非深度绑定尚未稳定的平台。短期可做通用插件练手,长期应聚焦独特资源,避免陷入低门槛竞争。生态初期红利虽诱人,但只有构建不可替代的
关键词:大模型对比、模型选型、聚合 API、Python 实战适用:做 AI 应用的同学想快速给模型「摸底」
本文介绍了DeepSeek Harness桌面版的安装配置方法。DeepSeek Harness是一个开源的AI Agent运行环境,支持插件扩展、任务执行和长期会话保留。文章详细讲解了macOS和Windows系统的安装步骤,并提供了配置llapi.org API Key的具体方法。安装完成后,用户可以通过简单的测试消息验证连接是否成功。文中还包含了常见问题解答以及安全使用提醒,建议用户从官方渠
2026年8月,全球主流AI厂商Anthropic正式为新版Claude模型上线隐形水印功能,标志着AI写作正式进入可溯源的留痕时代,这也是全球首个大规模落地的文本AI隐形水印方案。在AI Token生成过程中,通过控制高频虚词的出现节奏、主动语态/被动语态切换频率,在文本统计分布中嵌入人眼完全无法察觉的加密标记,只有持有对应密钥的检测工具才能识别。谷歌、OpenAI、Meta等头部AI厂商均已在
Deepseek Harness的实操
做 AI 应用的同学大概率都被这件事折磨过:想同时用 Claude 写代码、GPT 做推理、Gemini 处理多模态、DeepSeek 压成本……结果就是。有没有一种办法——?这篇就用 TokenPortal 走一遍,从零到跑通,控制在 10 分钟以内。
普通问答和知识类基准也不虚:SWE-bench Verified 80.6%(开源权重模型里的最高分,和 Gemini 3.1 Pro 持平),GPQA Diamond 90.1%,MMLU-Pro 87.5%,LiveCodeBench 93.5%(竞赛代码通过率,目前世界第一档),Codeforces 评分 3206(约等于人类前 23 名的水平)。价格上,V4 Pro 目前是 V4 Flas
deepseek harness
🤖 AI:DeepSeek V4-Pro 上线 + 开源 Harness(成本仅 Fable 5 约 1/60);Qwen3.8 Max 开放权重;Grok 4.6;Anthropic 商业客户首超 OpenAI;巨头争抢 AI 办公 Agent(微软统一 Copilot,腾讯/阿里/字节/谷歌跟进)。💾 半导体:台积电 CoWoS 良率 98%;苹果 A20 Pro 首款 2nm 手机芯片;
摘要:DeepSeek API近期涨价,主要因早期优惠结束及输出token单价上浮,对高频调用的开发者影响较大。个人用户面临调用频率受限、成本上升问题。作者选择通过CCSwitch灵活切换API来源,并接入lapi.org实现约官方一折的低成本调用,但仅支持V4Flash模型,适用于轻量场景。建议用户合理评估需求,测试稳定性,保留官方渠道兜底,并关注模型支持范围。最终方案兼顾成本与灵活性,适合日常
本文通过公开基准测试对比了DCS Genpilot与Claude Science、biomni等主流科研Agent的性能表现。研究表明,决定科研Agent性能的关键在于智能体框架(Harness)的领域适配性,而非单纯依赖大模型性能。Genpilot通过优化任务编排和工具调度,实现了用低成本开源模型达到接近顶级闭源模型的科研分析能力。
DeepSeek 靠的是”技术口碑与开发者社群的自然传播”(QuestMobile 报告原话),是”你主动找去”。2025 年 2 月 DeepSeek 曾以 1.94 亿月活登顶,如今 1.30 亿且下滑——这是”分化”,不是”幸存”。所以”配”会自我强化成”离不开”——你的切换成本论,点中的正是这一下”锁死”。DeepSeek 没斩杀豆包,不是因为它不够强,而是因为消费市场从来不为”最强”买单
对于需要本地化部署大模型或进行AI训练的团队,P5平台也支持DeepSeek等主流框架的运行,参考价格约42,500元起,是科研机构和高端制造企业研发部门的理想计算平台。2TB固态加4TB机械硬盘的存储方案兼顾了项目文件的高速读写与历史数据的长期归档,参考价格约22,500元起,是建筑设计院和工程咨询公司批量部署的常见选择。联想ThinkStation系列凭借清晰的梯度布局和丰富的ISV认证体系,
OpenClaw,这款开源 AI Agent 框架,凭借强大的能力和灵活的扩展性,在 GitHub 上收获数万 Star、数百篇教程和实践分享,成为全球开发者关注的焦点。无论是科研机构、量化团队,还是数据分析师与内容创作者,都在探索如何让 AI 自动化执行任务,从信息抓取到多 Agent 协作再到智能推送。随着 ClawX 的应用,全球用户不再受部署复杂性限制,AI Agent 正真正成为日常工作
墨鱼团,你们好呀。1、《中国人民银行“十五五”改革发展规划》2、国金证券deepseek金融适配度评测方法3、上海医圆影像智能体。
目前,OpenHubs已接入Qwen、Kimi、DeepSeek、智谱GLM、豆包Seed等主流模型,并持续完善文本、推理、代码、视觉、视频等多模型、多模态能力体系,推动先进AI能力加快转化为消费产业的实际应用价值。未来,值得买科技将坚定实施“全面AI”战略,依托OpenHubs快速上线行业领先模型,完善多模型、多模态能力体系,对内推动业务提质增效与创新发展,对外为企业客户和开发者提供更加灵活、高
本文介绍了一套工程化的APK逆向分析方法APKReverseHarness,旨在解决传统逆向过程中存在的代码迷路、结论碎片化等问题。该框架将逆向流程拆分为11个阶段,从授权确认到最终报告生成,强调证据锚点和结构化输出。作者指出AI辅助逆向的关键在于流程约束而非自由发挥,并对比了"关键词搜索"与"工程化拆解"的区别,特别澄清了加密/编码/校验等概念的误判风险。
阿里巴巴发布第三代图像生成模型Qwen-Image-3.0,核心突破在于"实用性"("实")。相比前代,该模型支持4.5k token长指令输入,可实现复杂布局生成;细节渲染达10px极小文字精度;原生支持12种语言和多种专业场景。技术架构采用创新的MMDiT(多模态扩散变换器),通过端到端联合建模、MSROPE位置编码等实现文本与图像的深度对齐。模型参数量达200亿,支持1024×1024分辨率
熵(Entropy)的概念源自信息论,由 Claude Shannon 于 1948 年提出,用于度量系统的不确定性或信息量。心肌组织的熵值越高,意味着像素强度的分布越复杂,对应的组织异质性也越大。H−∑i1nPχilog2PχiH−i1∑nPχilog2Pχi计算出的数值即为 LV 熵值。类型计算范围临床含义LV 全局熵整个 LV 心肌的像素强度分布心肌整体组织异质性LV LGE 熵。
选GEO公司之前,你需要先搞清楚GEO到底是什么。否则,你根本没办法判断对方是内行还是外行。GEO不是SEO,不是关键词排名优化,不是网站权重提升。GEO的本质是:让你的品牌/产品/服务,在AI搜索时代被AI引用、被AI推荐。当用户在DeepSeek、豆包、腾讯元宝里问一个问题,AI会从海量互联网内容中检索、整合、生成答案。你的品牌要做的,是让AI认为”这条内容值得被引用”。SEO:让你的网站排在
🤖 AI:扎克伯格否认 Meta 算力过剩,推出云计算租赁;苹果起诉 OpenAI 系统性窃密,一年挖走 400+ 员工;智谱发内部信押注 LLM OS;MiniMax 融资 160 亿港元,创始人零薪酬;xAI Grok CLI 被曝静默上传代码库;阶跃星辰 vs 努比亚争夺首款 AI 智能体手机;微信 AI 小程序 10 亿 Token 免费额度上线。💾 半导体:SK 海力士 CEO 预警
AI搜索的流量红利期刚刚开始,GEO正从“可选动作”变成“必选基建”。本文从原理到代码、从对比到避坑,为你梳理了一条清晰的落地路径。如果想进一步探索,可以从最小的业务场景入手,先用自动化工具把一条核心信息推出去,感受一下被AI“主动提起”带来的流量反馈。技术的发展总是这样——当多数人还在观望时,提前适配的那一小撮已经吃到了第一波红利。参考资料:众馨科技04号员工技术文档、DeepSeek/豆包开发
本课程正是基于这一技术变革与科研深度需求的交汇而设计,以NASA GIBS/EONET真实遥感数据为核心驱动,通过两天全链路实战,完整跑通从数据接入、Leaflet/MapLibre交互地图、ECharts科技大屏与Canvas动效可视化、PostGIS空间数据库、Express后端接口到阿里云公网部署的技术闭环,现场完成八大科研专题系统,帮助每位学员带走一套可上线运行、可替换自有研究区数据、可直
🤖 AI:OpenAI 获美政府批准全面发布 GPT-5.6 系列;Claude Cowork 首次登陆移动端和网页端;Anthropic 延长 Fable 5 免费期至 7 月 12 日;OpenAI 首席未来学家 Achiam 九年离职;腾讯混元 Hy3 调用激增紧急扩容;首个自主 AI 勒索软件 JADEPUFFER 完整分析公布。💾 半导体:SK 海力士 294 亿美元纽交所 IPO
亚洲经济体正凭借庞大的数字人口、丰富的应用场景和系统化的政策推动,从AI追随者转变为引领者。从底层算力到上层应用,从模型训练到产业落地,中国AI正在走出一条属于自己的路。这对许多处理敏感信息的企业、担心AI服务涨价的用户来说,是实实在在的价值。——这些市场对某些AI巨头来说优先级相对靠后,但中国AI公司看到了不一样的图景:它们不是“低端市场”,而是高速增长的市场。这条路,DeepSeek走过,阿里
【摘要】工业控制场景对通用大模型存在三大挑战:延迟高(需毫秒级响应)、精度不足(需确定性输出)、改造成本高。中嵌科技"岷山"实验室提出垂类解决方案:基于DeepSeek-LLM-7B模型,采用LoRA+MoE微调、混合量化、剪枝和知识蒸馏技术,将模型压缩至原体积15%-20%,保持精度损失<1%,推理延迟≤50ms,并实现与现有DCS/PLC架构无缝对接。其技术路径包含时
在豆包桌面端中,你可以直接上传你的 PPT 模板,通过对话式的指令,让它帮你润色、扩写或重构内容。在此之前,行业内公认能够精确修改 PPT 模板的模型,只有 Claude Opus 和 GPT 5.5 可以(GPT 5.4 都不行),而 Seed 2.1 Pro 成为了第三个迈过这道门槛的模型。如果你是企业开发者,希望将这种强大的模型能力集成到自己的工作流或产品中,可以通过火山引擎接入 Seed
智谱 GLM-5.2 安全基准超越 Claude Opus 4.8——国产模型在网络安全评测上取得进展; 美团一日 9 连发——LongCat 系列全线开源,覆盖音频到定理证明; Google Labs 发布 DESIGN.md 格式规范——AI 协作文档标准化再进一步; PPT Master 开源——从 Markdown 一键生成原生可编辑 PPT; AI-Berkshire 多智能体投资分析框
Kimi 率先商用128万~200万Token上下文窗口,DeepSeek、GLM、Qwen也支持100万+,在中文超长文档(合同、研报、全书)的信息提取、摘要、问答上,体验和Claude并驾齐驱甚至中文准确率更优。可灵(Kling)、即梦(Seedance)等国产文生视频模型在人物面部一致性、图生视频、中式审美风格还原上,已可比肩或局部超过Runway Gen-4、Sora早期版,且生成成本大幅
优势:短视频创作、办公、数字人、AI 绘图 / 生视频,对接抖音、剪映、飞书生态,C 端用户规模国内第一。ERNIE 文心大模型,依托百度搜索知识库,长文本、知识问答、文心一格 AI 绘画、文心快码,政企、教育、政务落地成熟;实时语音转写、口语测评、智能会议、教育硬件适配,面向课堂、医疗、车载语音场景优势明显。Claude 5 系列,主打超长上下文、高 AI 安全、低幻觉,金融、法律、咨询行业企业
打开网页,扫码登录,结束。如果你不懂得精细设置 Token 上限和本地访问权限,在它全速替你跑任务时,稍不留神就可能烧掉一笔不菲的 API 费用,甚至因为授权过大而导致本地文件被误改误删。设定好规则,让它每天早上8点自动抓取微博/知乎热榜,按你的语气生成3篇选题大纲和初稿,可以直接推送到飞书。但OpenClaw的定位更偏向极客和开发者,对咱们普通打工人来说,想要驾驭它的“门槛”确实还是高了点。让它