大家都是怎么判断自己选的大模型的缓存率高低啊?
好像不同模型的缓存率不一样?大家都是怎么判断自己选的大模型的缓存率高低啊 主要是看了一些报告,但实操性不强
AI 资讯
已同步 1463 条公开资讯,来源和发布时间保留在每条记录中。
AIGOOD 已同步公开来源;每条资讯详情保留来源和原文链接。
好像不同模型的缓存率不一样?大家都是怎么判断自己选的大模型的缓存率高低啊 主要是看了一些报告,但实操性不强
点击查看原文
Anthropic 拿出了目前最快的小模型,同时一口气砍了两刀价格。10 月 7 日发布的 Claude Haiku 5.5 是 Haiku 系列第一个支持可调节 effort 设置的型号,用户可以根据场景在速度和智能之间做取舍。 价格直接跌到 Haiku 4.5 的约四分之一——输入每百万 token 0.10 美元、输出 0.50 美元(不超过 10 万 token 的提示),缓存...
皮尤研究中心对 37 国民众展开的调查显示,世界各地民众认为社交媒体伤害民主的比例过去几年在上升。其中美国民众对社媒的看法尤其负面,64% 的成年人认为它对民主有害。其它国家在认识到社交媒弊端方面正赶上美国。美国等富裕国家的民众倾向于认为社媒在伤害民主。在受访国家中,认为社媒对民主产生负面影响的人数比例达到或超过半数的七个国家同时也都是最富裕的国家:澳大利亚、加拿大、法国、德国、荷兰、英国和美国。以色列和新加坡是例外——这两个高收入国家认为社媒不利于民主的人数相对较少。GDP 较低国家民众对社媒的看法不那么负面。…
Manus 在离开 Meta 之后,拿到了它的第一笔融资:超过 5 亿美元。母公司 Butterfly Effect 星期四宣布,这轮由私募股权机构博裕资本和风投 IDG Capital 联合领投,腾讯、HSG(红杉中国)、真格基金等老股东跟投。公司没有披露投后估值——但彭博上月已经报道,这轮估值将翻倍到 40 亿美元,让 Manus 成为中国估值最高的 ...
韩国新韩银行、KB国民银行、韩亚银行等 7家 金融企业遭遇黑客攻击,多处发现同一攻击者利用了开源渗透测试工具“ARTEX-自主渗透测试控制台”实施攻击的迹象。CrowdStrike 公布分析报告显示,嫌疑人可能为居住在广东的 26 岁人员。但这只是根据目前情况作出的推测,嫌疑人身份尚未确定。攻击者使用生成式 AI 编码工具 Claude Code 的过程中暴露了这条线索,即攻击者利用 Claude Code 制作包含其渗透测试成果的网络安全研究人员简历,在此过程中输入自己名字的首字母、社交平台电报账号、学历和…
OpenAI 公布了一份报告,称其一款尚未发布的前沿模型解决了数百个数学难题,其中之一是四维挂谷猜想,今年的菲尔茨奖得主王虹就是因为证明三维挂谷猜想而得奖。UCLA 数学家陶哲轩对此评论说,在传统数学的 1.0 时代,知名难题的证明通常会引发一系列后续的活动,证明作者会受邀参加演讲,与该领域的专家展开讨论,相关研讨会会组织起来去探讨该证明及最新进展。通过这些活动,证明过程被消化和精简,被置于该领域其他成果的背景下,最终成为下一代数学家的教科书和讲义内容。但 AI 模型的证明则是由对数学兴趣不大的人通过提示词自主解…
OpenAI 这次是把 GPT-6 推给了所有人。10 月 7 日起,Plus、Pro、Business、Enterprise 用户陆续用上 GPT-6 Sol;10 月 8 日,Free 和 Go 用户也拿到 GPT-6 Luna。和模型一起上线的,是一套叫 Intelligent UI 的新界面——ChatGPT 的回答不再只是连续文字,而是会冒出可点击的按钮、表单、图表、内嵌地图,甚至计算器这类...
【摘要】具身智能感知简述(Manipulation) —— 经典VLA 本文围绕 RT-1、RT-2、OpenVLA、CogACT 和 π₀ 五项代表性工作,结合论文架构图与机器人演示,简要梳理 VLA(Vision-Language-Action)模型 的发展脉络,介绍各模型的基本架构、主要思路及其区别, 阅读全文
开发 Agent 时,RAG 检索到底应该设计成 Tool 还是 Node? 最近在做一个企业级 RAG Agent,技术栈主要是 Python + LangGraph,Agent 需要完成知识库检索、问题分析、多轮推理、工具调用以及最终回答。 目前在设计 Agent Workflow 时遇到了一个比较纠结的问题: RAG 检索到底应该作为 Agent 的 Tool,还是作为 Workflow 中独立的 Node?
Docker 官方上架了一个新工具:Docker Agent。定位一句话就够——「Build, run, and share AI agents with a declarative YAML config」:用 YAML 声明式配置定义 Agent,配上工具和多 Agent 编排,就能跑起来。它是个 docker CLI 插件,装好 Docker Desktop 4.63+ 后直接 docker agent 就能用,Homebrew(brew install ...
Libra 是一款 AI 原生、兼容 Git 的版本控制系统,它还会记录工作是如何完成的——并把这份记忆保存在你的仓库里。
Libra 是一款 AI 原生、兼容 Git 的版本控制系统,它还会记录工作是如何完成的——并把这份记忆保存在你的仓库里。
OpenAI 正在 ChatGPT 和 Codex 中嵌入机器可读的水印技术 textGrain,该水印最初将主要针对欧盟地区的用户。OpenAI 称其水印技术不逊色甚至优于其它水印方案如 Google DeepMind 的 SynthID,OpenAI 竞争对手 Anthropic 已在 8 月宣布了基于 SynthID 的水印技术,此举是为了遵守欧盟的新法律 AI Act。OpenAI 还表示,嵌入水印的文本生成性能与未嵌入水印时的性能相当。
同一份招标文件,十几家投标人同时应标。评审专家要在厚厚的一摞标书中挑出“最懂需求、最贴实际”的那份。可现实是——绝大多数标书读起来都差不多。 这背后有三个绕不开的痛点: 第一,套模板套到千篇一律。 翻出往年标书改一改就交,话术都熟,却没有“非你不可”的独特气质。 第二,人工编写效率低、顾此失彼。 技术...
【摘要】一文搞懂 Function Calling:大模型究竟是如何调用工具的? 我们知道,传统的大语言模型(LLM)主要负责理解和生成文本。 但是,像 Claude Code、Codex 这样的 AI Agent,不仅能够回答问题,还可以读取文件、执行终端命令、搜索网页,甚至修改整个项目的代码。 这就引出 阅读全文
点击查看原文
点击查看原文
Goldfish Scheme(金鱼 Scheme) 是一款致力于“像 Python 一样实用易用,同时保持 Lisp 优雅”的现代化 Scheme 解释器。基于轻量高效的 S7 Scheme 引擎打造,具备 R7RS 兼容、轻量快速、安装包不到 5MB 以及 AI Coding 友好等特性。 近期,Goldfish Scheme 迎来了连续 8 个版本(v18.11.31 至 v18.11.39)的高密度演进与...
【摘要】上个月用 Claude Code 连着干了几天需求,账单出来的时候我愣了一下。 400 万个 tokens。Claude Sonnet 4.6,$3 输入 / $15 输出,保守估算下来将近 $26。不是说它贵,是突然意识到:这只是一周的编码量。如果是个认真用 AI 工具的工程师,每个月的消费可能超 阅读全文