- 使用 Spring Initializr 创建 Spring Boot 应用程序
- 在Spring Boot中配置Cassandra
- 在 Spring Boot 上配置 Tomcat 连接池
- 将Camel消息路由到嵌入WildFly的Artemis上
本文整理了Java中org.archive.io.warc.WARCWriter
类的一些代码示例,展示了WARCWriter
类的具体用法。这些代码示例主要来源于Github
/Stackoverflow
/Maven
等平台,是从一些精选项目中提取出来的代码,具有较强的参考意义,能在一定程度帮忙到你。WARCWriter
类的具体详情如下:
包路径:org.archive.io.warc.WARCWriter
类名称:WARCWriter
[英]WARC implementation.
Assumption is that the caller is managing access to this WARCWriter ensuring only one thread accessing this WARC instance at any one time.
While being written, WARCs have a '.open' suffix appended.
[中]WARC实现。
假设调用方正在管理对这个WARCWriter的访问,确保在任何时候只有一个线程访问这个WARC实例。
在编写WARC时,WARC有一个。附加了“打开”后缀。
代码示例来源:origin: internetarchive/heritrix3
writer = new WARCWriter(
new AtomicInteger(),
bos,
writer.writeWarcinfoRecord(warc.getName(),
"Made from " + reader.getReaderIdentifier() + " by " +
this.getClass().getName() + "/" + getRevision());
l.setLevel(Level.WARNING);
try {
writer.close();
} finally {
l.setLevel(oldLevel);
代码示例来源:origin: internetarchive/heritrix3
protected URI writeFtpControlConversation(WARCWriter w, String timestamp,
URI baseid, CrawlURI curi, ANVLRecord headers,
String controlConversation) throws IOException {
WARCRecordInfo recordInfo = new WARCRecordInfo();
recordInfo.setCreate14DigitDate(timestamp);
recordInfo.setUrl(curi.toString());
recordInfo.setMimetype(FTP_CONTROL_CONVERSATION_MIMETYPE);
recordInfo.setExtraHeaders(headers);
recordInfo.setEnforceLength(true);
recordInfo.setType(WARCRecordType.metadata);
recordInfo.setRecordId(qualifyRecordID(baseid, TYPE, WARCRecordType.metadata.toString()));
byte[] b = controlConversation.getBytes("UTF-8");
recordInfo.setContentStream(new ByteArrayInputStream(b));
recordInfo.setContentLength((long) b.length);
w.writeRecord(recordInfo);
return recordInfo.getRecordId();
}
代码示例来源:origin: internetarchive/heritrix3
protected void updateMetadataAfterWrite(final CrawlURI curi,
WARCWriter writer, long startPosition) {
if (WARCWriter.getStat(writer.getTmpStats(), WARCWriter.TOTALS, WARCWriter.NUM_RECORDS) > 0l) {
addStats(writer.getTmpStats());
urlsWritten.incrementAndGet();
+ WARCWriter.getStat(writer.getTmpStats(), WARCWriter.TOTALS, WARCWriter.SIZE_ON_DISK)
+ " bytes to " + writer.getFile().getName() + " for " + curi);
setTotalBytesWritten(getTotalBytesWritten() + (writer.getPosition() - startPosition));
curi.addExtraInfo("warcFilename", writer.getFilenameWithoutOccupiedSuffix());
curi.addExtraInfo("warcFileOffset", startPosition);
curi.getData().put(A_WARC_STATS, copyStats(writer.getTmpStats()));
history[0].put(A_WRITE_TAG, writer.getFilenameWithoutOccupiedSuffix());
for (WARCRecordInfo warcRecord: writer.getTmpRecordLog()) {
if ((warcRecord.getType() == WARCRecordType.response
|| warcRecord.getType() == WARCRecordType.resource)
代码示例来源:origin: internetarchive/heritrix3
writer.resetTmpStats();
writer.resetTmpRecordLog();
long position = writer.getPosition();
try {
writer.checkSize();
if (writer.getPosition() != position) {
(writer.getPosition() - position));
addStats(writer.getTmpStats());
writer.resetTmpStats();
writer.resetTmpRecordLog();
position = writer.getPosition();
代码示例来源:origin: org.netpreserve.commons/webarchive-commons
header = createRecordHeader(recordInfo);
long startPosition;
startPosition = getPosition();
try {
preWriteRecordTasks();
write(bytes);
totalBytes += bytes.length;
write(CRLF_BYTES);
totalBytes += CRLF_BYTES.length;
contentBytes += copyFrom(recordInfo.getContentStream(),
recordInfo.getContentLength(),
recordInfo.getEnforceLength());
write(CRLF_BYTES);
write(CRLF_BYTES);
totalBytes += 2 * CRLF_BYTES.length;
recordInfo.setWARCFilename(getFilenameWithoutOccupiedSuffix());
recordInfo.setWARCFileOffset(startPosition);
tmpRecordLog.add(recordInfo);
} finally {
postWriteRecordTasks();
tally(recordInfo.getType(), contentBytes, totalBytes, getPosition() - startPosition);
代码示例来源:origin: ViDA-NYU/ache
@Override
public boolean insert(Page target) {
try {
if (writer == null) {
createWarcWriter();
}
WARCRecordInfo warcRecord = getWarcRecordInfo(target, generator.getRecordID());
synchronized (writer) {
writer.checkSize();
writer.writeRecord(warcRecord);
writer.resetTmpStats();
writer.resetTmpRecordLog();
}
return true;
} catch (IOException e) {
logger.error("Exception thrown while creating a WARC record.", e);
}
return false;
}
代码示例来源:origin: iipc/openwayback
private void writeHeaderRecord(File target, File fieldsSrc, String id)
throws IOException {
WARCWriter writer = null;
BufferedOutputStream bos =
new BufferedOutputStream(new FileOutputStream(target));
FileInputStream is = new FileInputStream(fieldsSrc);
ANVLRecord ar = ANVLRecord.load(is);
List<String> metadata = new ArrayList<String>(1);
metadata.add(ar.toString());
writer = new WARCWriter(new AtomicInteger(),bos,target,getSettings(true, null, null, metadata));
// Write a warcinfo record with description about how this WARC
// was made.
writer.writeWarcinfoRecord(target.getName(), "Made from "
+ id + " by "
+ this.getClass().getName());
}
private WARCWriterPoolSettings getSettings(final boolean isCompressed,
代码示例来源:origin: org.netpreserve.commons/commons-web
recordInfo.setEnforceLength(true);
recordInfo.setRecordId(generateRecordId(TYPE, WARCRecordType.warcinfo.toString()));
writeRecord(recordInfo);
代码示例来源:origin: org.netpreserve.commons/webarchive-commons
protected WriterPoolMember makeWriter() {
return new WARCWriter(serialNo, (WARCWriterPoolSettings)settings);
}
}
代码示例来源:origin: org.netpreserve.commons/webarchive-commons
public URI writeWarcinfoRecord(String filename)
throws IOException {
return writeWarcinfoRecord(filename, null);
}
代码示例来源:origin: iipc/webarchive-commons
public String getFilenameWithoutOccupiedSuffix() {
String name = getFile().getName();
if (name.endsWith(ArchiveFileConstants.OCCUPIED_SUFFIX)) {
name = name.substring(0, name.length() - ArchiveFileConstants.OCCUPIED_SUFFIX.length());
}
return name;
}
代码示例来源:origin: org.netpreserve.commons/webarchive-commons
protected String createRecordHeader(WARCRecordInfo metaRecord)
throws IllegalArgumentException {
final StringBuilder sb =
new StringBuilder(2048/*A SWAG: TODO: Do analysis.*/);
sb.append(WARC_ID).append(CRLF);
sb.append(HEADER_KEY_TYPE).append(COLON_SPACE).append(metaRecord.getType()).
append(CRLF);
// Do not write a subject-uri if not one present.
if (!StringUtils.isEmpty(metaRecord.getUrl())) {
sb.append(HEADER_KEY_URI).append(COLON_SPACE).
append(checkHeaderValue(metaRecord.getUrl())).append(CRLF);
}
sb.append(HEADER_KEY_DATE).append(COLON_SPACE).
append(metaRecord.getCreate14DigitDate()).append(CRLF);
if (metaRecord.getExtraHeaders() != null) {
for (final Iterator<Element> i = metaRecord.getExtraHeaders().iterator(); i.hasNext();) {
sb.append(i.next()).append(CRLF);
}
}
sb.append(HEADER_KEY_ID).append(COLON_SPACE).append('<').
append(metaRecord.getRecordId().toString()).append('>').append(CRLF);
if (metaRecord.getContentLength() > 0) {
sb.append(CONTENT_TYPE).append(COLON_SPACE).append(
checkHeaderLineMimetypeParameter(metaRecord.getMimetype())).append(CRLF);
}
sb.append(CONTENT_LENGTH).append(COLON_SPACE).
append(Long.toString(metaRecord.getContentLength())).append(CRLF);
return sb.toString();
}
代码示例来源:origin: org.netpreserve.commons/webarchive-commons
protected String checkHeaderValue(final String value)
throws IllegalArgumentException {
for (int i = 0; i < value.length(); i++) {
final char c = value.charAt(i);
baseCharacterCheck(c, value);
if (Character.isWhitespace(c)) {
throw new IllegalArgumentException("Contains disallowed white space 0x" +
Integer.toHexString(c) + ": " + value);
}
}
return value;
}
代码示例来源:origin: org.netpreserve.commons/commons-web
header = createRecordHeader(recordInfo);
startPosition = getPosition();
preWriteRecordTasks();
write(bytes);
totalBytes += bytes.length;
write(CRLF_BYTES); // TODO: should this be written even for zero-length?
totalBytes += CRLF_BYTES.length;
contentBytes += copyFrom(recordInfo.getContentStream(),
recordInfo.getContentLength(),
recordInfo.getEnforceLength());
write(CRLF_BYTES);
write(CRLF_BYTES);
totalBytes += 2 * CRLF_BYTES.length;
tally(recordInfo.getType(), contentBytes, totalBytes, getPosition() - startPosition);
recordInfo.setWARCFilename(getFilenameWithoutOccupiedSuffix());
recordInfo.setWARCFileOffset(startPosition);
tmpRecordLog.add(recordInfo);
} finally {
postWriteRecordTasks();
代码示例来源:origin: org.archive.heritrix/heritrix-modules
writer.resetTmpStats();
writer.resetTmpRecordLog();
long position = writer.getPosition();
try {
writer.checkSize();
if (writer.getPosition() != position) {
(writer.getPosition() - position));
addStats(writer.getTmpStats());
writer.resetTmpStats();
writer.resetTmpRecordLog();
position = writer.getPosition();
代码示例来源:origin: org.netpreserve.openwayback/openwayback-core
private void writeHeaderRecord(File target, File fieldsSrc, String id)
throws IOException {
WARCWriter writer = null;
BufferedOutputStream bos =
new BufferedOutputStream(new FileOutputStream(target));
FileInputStream is = new FileInputStream(fieldsSrc);
ANVLRecord ar = ANVLRecord.load(is);
List<String> metadata = new ArrayList<String>(1);
metadata.add(ar.toString());
writer = new WARCWriter(new AtomicInteger(),bos,target,getSettings(true, null, null, metadata));
// Write a warcinfo record with description about how this WARC
// was made.
writer.writeWarcinfoRecord(target.getName(), "Made from "
+ id + " by "
+ this.getClass().getName());
}
private WARCWriterPoolSettings getSettings(final boolean isCompressed,
代码示例来源:origin: org.netpreserve.commons/webarchive-commons
recordInfo.setEnforceLength(true);
recordInfo.setRecordId(generateRecordId(TYPE, WARCRecordType.warcinfo.toString()));
writeRecord(recordInfo);
代码示例来源:origin: org.netpreserve.commons/commons-web
protected WriterPoolMember makeWriter() {
return new WARCWriter(serialNo, (WARCWriterPoolSettings)settings);
}
}
代码示例来源:origin: org.netpreserve.commons/commons-web
public URI writeWarcinfoRecord(String filename)
throws IOException {
return writeWarcinfoRecord(filename, null);
}
代码示例来源:origin: org.netpreserve.commons/commons-web
public String getFilenameWithoutOccupiedSuffix() {
String name = getFile().getName();
if (name.endsWith(ArchiveFileConstants.OCCUPIED_SUFFIX)) {
name = name.substring(0, name.length() - ArchiveFileConstants.OCCUPIED_SUFFIX.length());
}
return name;
}
这个问题在这里已经有了答案: 关闭 11 年前。 Possible Duplicate: Sample data for IPv6? 除了 wireshark 在其网站上提供的内容之外,是否有可以下
我正在寻找可以集成到现有应用程序中并使用多拖放功能的示例或任何现成的解决方案。我在互联网上找到的大多数解决方案在将多个项目从 ListBox 等控件拖放到另一个 ListBox 时效果不佳。谁能指出我
我是 GATE Embedded 的新手,我尝试了简单的示例并得到了 NoClassDefFoundError。首先我会解释我尝试了什么 在 D:\project\gate-7.0 中下载并提取 Ga
是否有像 Eclipse 中的 SWT 示例那样的多合一 JFace 控件示例?搜索(在 stackoverflow.com 上使用谷歌搜索和搜索)对我没有帮助。 如果它是一个独立的应用程序或 ecl
我找不到任何可以清楚地解释如何通过 .net API(特别是 c#)使用谷歌计算引擎的内容。有没有人可以指点我什么? 附言我知道 API 引用 ( https://developers.google.
最近在做公司的一个项目时,客户需要我们定时获取他们矩阵系统的数据。在与客户进行对接时,提到他们的接口使用的目前不常用的BASIC 认证。天呢,它好不安全,容易被不法人监听,咋还在使用呀。但是没办法呀,
最近在做公司的一个项目时,客户需要我们定时获取他们矩阵系统的数据。在与客户进行对接时,提到他们的接口使用的目前不常用的BASIC 认证。天呢,它好不安全,容易被不法人监听,咋还在使用呀。但是没办法呀,
我正在尝试为我的应用程序设计配置文件格式并选择了 YAML。但是,这(显然)意味着我需要能够定义、解析和验证正确的 YAML 语法! 在配置文件中,必须有一个名为 widgets 的集合/序列。 .这
你能给我一个使用 pysmb 库连接到一些 samba 服务器的例子吗?我读过有类 smb.SMBConnection.SMBConnection(用户名、密码、my_name、remote_name
linux服务器默认通过22端口用ssh协议登录,这种不安全。今天想做限制,即允许部分来源ip连接服务器。 案例目标:通过iptables规则限制对linux服务器的登录。 处理方法:编
我一直在寻找任何 PostProjectAnalysisTask 工作代码示例,但没有看。 This页面指出 HipChat plugin使用这个钩子(Hook),但在我看来它仍然使用遗留的 Po
我发现了 GWT 的 CustomScrollPanel 以及如何自定义滚动条,但我找不到任何示例或如何设置它。是否有任何示例显示正在使用的自定义滚动条? 最佳答案 这是自定义 native 滚动条的
我正在尝试开发一个 Backbone Marionette 应用程序,我需要知道如何以最佳方式执行 CRUD(创建、读取、更新和销毁)操作。我找不到任何解释这一点的资源(仅适用于 Backbone)。
关闭。这个问题需要details or clarity .它目前不接受答案。 想改进这个问题?通过 editing this post 添加详细信息并澄清问题. 去年关闭。 Improve this
我需要一个提交多个单独请求的 django 表单,如果没有大量定制,我找不到如何做到这一点的示例。即,假设有一个汽车维修店使用的表格。该表格将列出商店能够进行的所有可能的维修,并且用户将选择他们想要进
我有一个 Multi-Tenancy 应用程序。然而,这个相同的应用程序有 liquibase。我需要在我的所有数据源中运行 liquibase,但是我不能使用这个 Bean。 我的应用程序.yml
我了解有关单元测试的一般思想,并已在系统中发生复杂交互的场景中使用它,但我仍然对所有这些原则结合在一起有疑问。 我们被警告不要测试框架或数据库。好的 UI 设计不适合非人工测试。 MVC 框架不包括一
我正在使用 docjure并且它的 select-columns 函数需要一个列映射。我想获取所有列而无需手动指定。 如何将以下内容生成为惰性无限向量序列 [:A :B :C :D :E ... :A
$condition使用说明和 $param在 findByAttributes在 Yii 在大多数情况下,这就是我使用 findByAttributes 的方式 Person::model()->f
我在 Ubuntu 11.10 上安装了 qtcreator sudo apt-get install qtcreator 安装的版本有:QT Creator 2.2.1、QT 4.7.3 当我启动
我是一名优秀的程序员,十分优秀!